speech-recognition
speech-recognition がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
TPU上で最大70倍の高速化を実現する、OpenAIのWhisperモデルのJAX実装
★ 4,679-1直近 7 日のスター増減 - #32
小型の音声認識器。
★ 4,337+2直近 7 日のスター増減 - #33
音声認識のためのWhisperの蒸留バリアント。6倍高速化、50%小型化、単語誤り率1%以内。
★ 4,114+2直近 7 日のスター増減 - #34
OpenAI Whisper ASR Web サービス API
★ 3,328+2直近 7 日のスター増減 - #35
Python の導入を避けたい人のための Whisper および Faster-Whisper のスタンドアロン実行ファイル
★ 3,171+2直近 7 日のスター増減 - #36★ 3,101+1直近 7 日のスター増減
- #37★ 3,068+2直近 7 日のスター増減
- #38★ 2,864+0直近 7 日のスター増減
- #39
単語レベルのタイムスタンプと信頼度を備えた多言語自動音声認識
★ 2,842+1直近 7 日のスター増減 - #40★ 2,606+1直近 7 日のスター増減
- #41
エージェントの対話、作業、存在感を維持するリアルタイム音声ランタイム。AI エージェント向けのリアルタイム音声ランタイム
★ 2,362+72直近 7 日のスター増減 - #42
🎙 tensorflowディープラーニングフレームワークと、sequence-to-sequenceニューラルネットワークを使用した音声認識
★ 2,173+0直近 7 日のスター増減 - #43★ 2,048+7直近 7 日のスター増減
- #44
中国語、方言、英語をサポートするオープンソースの産業グレード ASR モデル。パブリックな中国語 ASR ベンチマークで新たな SOTA を達成し、優れた歌声の歌詞認識能力も提供します。
★ 1,975+2直近 7 日のスター増減 - #45★ 1,968+0直近 7 日のスター増減
- #46★ 1,935+1直近 7 日のスター増減
- #47
話者分離(Speaker Diarization)に関する優れた論文、ライブラリ、データセット、その他のリソースのキュレーションリスト。
★ 1,894+1直近 7 日のスター増減 - #48
アプリのためのセルフコーディングシステム — iOS 向け Alan AI SDK
★ 1,878-3直近 7 日のスター増減 - #49
アプリのためのセルフコーディングシステム — Android用 Alan AI SDK
★ 1,807-1直近 7 日のスター増減 - #50
クロスプラットフォーム、GPU加速対応のWhisper 🏎️
★ 1,794+0直近 7 日のスター増減 - #51
インターネット接続なしで次世代Kaldiとncnnを使用したリアルタイム音声認識および音声区間検出(VAD)。iOS、Android、Linux、macOS、Windows、Raspberry Pi、VisionFive2、LicheePi4Aなどをサポート
★ 1,777-1直近 7 日のスター増減 - #52
アプリ向けセルフコーディングシステム — Flutter 用 Alan AI SDK
★ 1,756-1直近 7 日のスター増減 - #53
アプリのためのセルフコーディングシステム — Ionic 向け Alan AI SDK
★ 1,649-1直近 7 日のスター増減 - #54
Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。
★ 1,622+8直近 7 日のスター増減 - #55
AIを使用したローカル音声認識および字幕生成のためのOBSプラグイン
★ 1,597+8直近 7 日のスター増減 - #56★ 1,591-2直近 7 日のスター増減
- #57
ComfyUI の機能を拡張するカスタムノード
★ 1,525+1直近 7 日のスター増減 - #58★ 1,521+3直近 7 日のスター増減
- #59
中国語、方言、アクセント、多言語音声に対応した、オープンソースの LLM ベース ASR モデルファミリ。FunASR、vLLM、ストリーミング、llama.cpp ランタイムをサポート。
★ 1,512+10直近 7 日のスター増減 - #60★ 1,449+0直近 7 日のスター増減