メインコンテンツへスキップ
buildradar
Sign in

dimastatz/whisper-flow

@dimastatz

Whisper-Flowは、OpenAIのWhisperモデルを使用して音声コンテンツのリアルタイム文字起こしを実現するためのフレームワークです。アップロード後にファイル全体を処理する(「バッチモード」)のではなく、Whisper-Flowは音声チャンクの連続ストリームを受け取り、即座にインクリメンタルな文字起こしを生成します。

スター
964
フォーク
128
言語
Python
ライセンス
MIT
最終プッシュ
4 週間前
Pythonpythonwhispertranscriptionspeech-to-textpypi-package

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。