トピック · speech
speech
speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
74 件のリポジトリ
- #61
🐸 TTS 関連論文のコレクション
★ 734+1直近 7 日のスター増減 - #62
PyTorchで実装されたストリーミングおよび非ストリーミングの自動音声認識フレームワーク。オンラインおよびオフライン認識の両方に対応しており、現在Conformer、Squeezeformer、DeepSpeech2モデルをサポートし、多様なデータ拡張手法を備えています。
★ 727+0直近 7 日のスター増減 - #63★ 716+0直近 7 日のスター増減
- #64
PyTorch-LightningとHydraを活用したエンドツーエンド音声認識のためのオープンソースツールキット。
★ 714+0直近 7 日のスター増減 - #65★ 693+1直近 7 日のスター増減
- #66
Chatterboxを使用したローカルなOpenAI互換の音声合成(TTS)API。OpenAI APIが使用されるあらゆる場所(Open WebUI、AnythingLLMなど)で音声クローンによる音声生成を可能にします
★ 676+5直近 7 日のスター増減 - #67
MOSS-Audio は、統合された音声理解のためのオープンソース基盤モデルであり、現実世界のシナリオにおける音声、サウンド、音楽、キャプション生成、QA、推論を可能にします。
★ 655+4直近 7 日のスター増減 - #68★ 638+0直近 7 日のスター増減
- #69
音声分野の研究室、企業、リソース、インターンシップなど。推薦や自己推薦を歓迎します
★ 610+1直近 7 日のスター増減 - #70
公開されている部屋インパルス応答(RIR)データセットとダウンロード用スクリプトのリスト
★ 607+1直近 7 日のスター増減 - #71
SpeechIO Leaderboard: 自動音声認識のための大規模で堅牢かつ包括的なベンチマークプラットフォーム。
★ 553+3直近 7 日のスター増減 - #72★ 539+0直近 7 日のスター増減
- #73★ 524+1直近 7 日のスター増減
- #74
StarGANv2-VC: 自然な音声変換のための多様で教師なし、非平行なフレームワーク
★ 522+0直近 7 日のスター増減