speaker-diarization
speaker-diarization がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
speaker-diarization と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、speaker-diarization がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
トレーニング、推論、ストリーミングASR、VAD、句読点、話者ダイアライゼーションパイプライン、およびOpenAI互換/MCPサービングのためのオープンソース音声認識ツールキット
★ 20,136+64直近 7 日のスター増減 - #2
PyTorchベースの音声ツールキット
★ 11,802+10直近 7 日のスター増減 - #3
ストリーミングASR、話者ダイアライゼーション、翻訳、およびOpenAI/Deepgram互換APIを備えたリアルタイムローカル音声認識
★ 10,990+16直近 7 日のスター増減 - #4
話者ダイアライゼーションのためのニューラルビルディングブロック:音声活動検出、話者切り替わり検出、オーバーラップ音声検出、話者埋め込み。
★ 10,500+16直近 7 日のスター増減 - #5★ 9,949+3直近 7 日のスター増減
- #6
Apple Silicon向けオンデバイス音声AI
★ 6,353+8直近 7 日のスター増減 - #7
OpenAI Whisperに基づく話者ダイアライゼーション付き自動音声認識
★ 5,634+1直近 7 日のスター増減 - #8
Python の導入を避けたい人のための Whisper および Faster-Whisper のスタンドアロン実行ファイル
★ 3,171+2直近 7 日のスター増減 - #9
シングルおよびマルチモーダルの話者照合、話者認識、話者ダイアライゼーションのためのリポジトリ
★ 3,128+3直近 7 日のスター増減 - #10
単語レベルのタイムスタンプと信頼度を備えた多言語自動音声認識
★ 2,842+1直近 7 日のスター増減 - #11
アプリ内で最先端の CoreML 音声モデルを利用可能に — テキスト読み上げ、音声認識、音声区間検出、話者ダイアライゼーション。Swift 製、SOTA のオープンソースを活用。
★ 2,723+13直近 7 日のスター増減 - #12★ 2,024+1直近 7 日のスター増減
- #13
話者分離(Speaker Diarization)に関する優れた論文、ライブラリ、データセット、その他のリソースのキュレーションリスト。
★ 1,894+1直近 7 日のスター増減 - #14
中国語、方言、アクセント、多言語音声に対応した、オープンソースの LLM ベース ASR モデルファミリ。FunASR、vLLM、ストリーミング、llama.cpp ランタイムをサポート。
★ 1,512+10直近 7 日のスター増減 - #15★ 1,402+8直近 7 日のスター増減
- #16
Apple Silicon 向け AI 音声ツールキット — MLX と CoreML を活用した ASR、TTS、音声対音声、VAD、話者分離
★ 1,161+4直近 7 日のスター増減 - #17
LLM による要約を備えた、すぐに使えるセルフホスト型オフライン文字起こしおよび話者分離サービス
★ 948+2直近 7 日のスター増減 - #18
一站式全自动字幕生成软件,下载、转录、翻译、压制全流程覆盖,无需人工介入 / One-stop automated subtitle generator. Handles downloading, transcription, translation, and hardcoding—zero human intervention required.
★ 810+3直近 7 日のスター増減 - #19★ 677+0直近 7 日のスター増減
- #20
Googleのスピーカーダイアライゼーションに関する論文で使用されている(制約付き)スペクトラルクラスタリングアルゴリズムのPythonによる再実装
★ 555+0直近 7 日のスター増減