voice-cloning
voice-cloning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
リアルタイム音声アシスタント — WebRTC ストリーミング、faster-whisper ASR、ローカル LLM、Vui Nano (300M) TTS。OpenAI Realtime API 互換。音声クローン、発話割り込み (barge-in)、RTX 4090 で約 9 倍のリアルタイム処理。Apache 2.0 ライセンス。
★ 757+10直近 7 日のスター増減 - #32
MimikaStudio - macOS(Apple Silicon)向けのローカルファーストアプリケーション、Agentic MCPをサポート
★ 731+0直近 7 日のスター増減 - #33
Chatterboxを使用したローカルなOpenAI互換の音声合成(TTS)API。OpenAI APIが使用されるあらゆる場所(Open WebUI、AnythingLLMなど)で音声クローンによる音声生成を可能にします
★ 677+5直近 7 日のスター増減 - #34
PDF や EPUB をオーディオブックに、字幕や動画を(翻訳を含む)吹き替え動画に変換するなど。無料で使用できます。Pandrator は、音声クローン(インスタント、RVC 拡張、XTTS ファインチューニング)や LLM 処理などのローカルモデルを使用します。GUI、インストーラー、オールインワンパッケージを備えた、ユーザーフレンドリーなアプリを目指しています。
★ 620+3直近 7 日のスター増減 - #35
YouDubは、高品質なYouTube動画の翻訳と吹き替えを自動化し、中国のインターネット上に転載できるように設計されたオープンソースツールです。AI音声認識技術を使用して音声をテキストに変換し、大規模言語モデル(LLM)でテキストを中国語に翻訳し、最後にAI音声クローン技術で中国語を音声に変換します。これにより、元のYouTuberの声を再現した中国語吹き替え動画を作成できます。
★ 614-2直近 7 日のスター増減 - #36
VibeVoice TTS用のComfyUIカスタムノード。表現豊かで長文、マルチスピーカーの対話型オーディオ
★ 597+0直近 7 日のスター増減 - #37
テキストファイルを入力として受け付け、文字数制限のない Chatterbox の改造版です。主に子供向けのオーディオブックを作成するために使用しています。
★ 575-1直近 7 日のスター増減 - #38
Mac(M1/M2/M3/M4)でQwen3-TTSテキスト読み上げをローカル実行。音声クローン、音声デザイン、カスタム音声に対応。MLXを使用した100%オフライン動作。
★ 561+4直近 7 日のスター増減 - #39
パーソナライズされた音声クローン機能を備えた、世界初のオープンソースのリアルタイムエンドツーエンド音声対話モデル
★ 549-1直近 7 日のスター増減 - #40
ComfyUI用のOmniVoice TTSノード - 音声クローン、音声デザイン、マルチスピーカー対話に対応したゼロショット多言語音声合成
★ 543+5直近 7 日のスター増減 - #41
表現力豊かな音声とリアルなゼロショット音声クローンを実現する ComfyUI ノード
★ 510+1直近 7 日のスター増減