オーナー · QwenAudio
QwenAudio
QwenAudio の追跡中のオープンソースリポジトリを、スター数順に表示します。
6 件のリポジトリ
- #1★ 23,426+359直近 7 日のスター増減
- #2
Mandarin、Cantonese、English、Japanese、Korean向けのオープンソースのSenseVoiceSmallモデル。ASR、言語ID、感情認識、音声イベント検出に対応。
★ 9,209+37直近 7 日のスター増減 - #3
エージェントの対話、作業、存在感を維持するリアルタイム音声ランタイム。AI エージェント向けのリアルタイム音声ランタイム
★ 2,362+72直近 7 日のスター増減 - #4
中国語、方言、アクセント、多言語音声に対応した、オープンソースの LLM ベース ASR モデルファミリ。FunASR、vLLM、ストリーミング、llama.cpp ランタイムをサポート。
★ 1,512+10直近 7 日のスター増減 - #5
[NeurIPS 2025] Chain-of-Thought (CoT) 推論に誘導され、あらゆるモダリティから音声を生成する統合フレームワーク [ThinkSound] の PyTorch 実装
★ 1,378+0直近 7 日のスター増減 - #6
Fun-Audio-Chatは、自然で低レイテンシな音声対話のために構築された大規模音声言語モデルです。
★ 1,002+3直近 7 日のスター増減