voice-cloning
voice-cloning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
voice-cloning と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、voice-cloning がタグ付けされたリポジトリ。
- #1
1分の音声データでも優れたTTSモデルのトレーニングに使用可能!(Few-shotボイスクローニング)
★ 61,476+138直近 7 日のスター増減 - #2
5秒で音声をクローンし、任意の音声をリアルタイムで生成
★ 60,117-4直近 7 日のスター増減 - #3★ 45,985+18直近 7 日のスター増減
- #4★ 36,595+345直近 7 日のスター増減
- #5★ 23,426+359直近 7 日のスター増減
- #6
電子書籍からオーディオブックを生成、ボイスクローニング&1158以上の言語に対応!
★ 20,097+34直近 7 日のスター増減 - #7
Netflixレベルの字幕カット、翻訳、アライメント、さらにはダビングまで対応 - ワンクリックで完全自動化されるAI動画字幕チーム | Netflix級の字幕カット、翻訳、アライメント、さらには吹き替えまで、ワンクリックで完全自動化されるAI字幕チーム
★ 18,339+49直近 7 日のスター増減 - #8
VoiceStudioは、完全にローカルで動作するオープンソースのElevenLabs代替ツールです。646言語で音声クローニング、音声デザイン、ビデオダビング、ディクテーション、文字起こし、オーディオブック作成に対応しています。
★ 14,835+2,880直近 7 日のスター増減 - #9
クリエイターと開発者のためのGradio WebUI。主要なTTS (Edge-TTS, kokoro) およびゼロショット音声クローニング (E2 & F5-TTS, CosyVoice) を特徴とし、Whisperオーディオ処理、YouTubeダウンロード、Demucsによるボーカル分離、多言語翻訳に対応。
★ 12,730+54直近 7 日のスター増減 - #10
自己教師あり学習モデル、句読点付きSOTA/ストリーミングASR、テキストフロントエンド付きストリーミングTTS、話者認証システム、エンドツーエンド音声翻訳、キーワードスポッティングを含む使いやすい音声ツールキット。NAACL2022最優秀デモ賞を受賞。
★ 12,676+5直近 7 日のスター増減 - #11★ 6,416+8直近 7 日のスター増減
- #12
オープンソースのAI動画ローカライゼーションツール:YouTube/Bilibili動画のダウンロード、字幕認識と翻訳、音声クローン吹き替え、音源ミキシング、字幕エンコードを自動実行。
★ 5,404+25直近 7 日のスター増減 - #13
MOSS‑TTSファミリーは、MOSI.AIとOpenMOSSチームによるオープンソースの音声・音響生成モデルファミリーです。高忠実度、高表現力、複雑な実世界シナリオ向けに設計されており、安定した長尺音声、マルチスピーカー対話、ボイス/キャラクターデザイン、環境音エフェクト、リアルタイムストリーミングTTSを網羅しています。
★ 4,058+18直近 7 日のスター増減 - #14★ 3,674+14直近 7 日のスター増減
- #15★ 2,818+1直近 7 日のスター増減
- #16
ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。
★ 2,214+115直近 7 日のスター増減 - #17★ 1,760+3直近 7 日のスター増減
- #18
強力な音声合成、画像生成、動画生成 API との連携を可能にする公式 MiniMax Model Context Protocol (MCP) サーバー
★ 1,573+2直近 7 日のスター増減 - #19
MicrosoftのVibeVoice音声合成モデル向けの包括的なComfyUI統合。ComfyUIのワークフロー内で直接、高品質なシングルおよびマルチスピーカーの音声合成を実現します。
★ 1,555+4直近 7 日のスター増減 - #20
人間の声を簡単に合成するための Python/PyTorch アプリケーション
★ 1,440+0直近 7 日のスター増減 - #21
強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。
★ 1,427+1直近 7 日のスター増減 - #22
💎 ASR、TTS、その他の音声技術向けにアクセス可能な音声コーパスのリスト
★ 1,399+0直近 7 日のスター増減 - #23★ 1,289-1直近 7 日のスター増減
- #24
様々な音声関連のNeural Network向けWebUI
★ 1,246+0直近 7 日のスター増減 - #25
絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル
★ 1,228+4直近 7 日のスター増減 - #26
ローカルでのマルチエンジン・多言語の音声合成(TTS)および音声変換を行うためのComfyUIカスタムノード統合。RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(クラシックおよび多言語)、F5-TTS、Higgs Audio 2、3、VibeVoiceをサポートし、無制限のテキスト長、SRTタイミング、キャラクターサポート、および多数のオーディオツールを備えています。
★ 1,187+7直近 7 日のスター増減 - #27
Apple Silicon向けのネイティブLLM推論サーバー。OpenAIおよびAnthropic API互換。Python不要。チャット、エージェントモード、ツール呼び出し機能を備えたMLX Core macOSアプリを同梱。
★ 1,115+245直近 7 日のスター増減 - #28
AIを活用したマルチボイスオーディオブックジェネレーター — LLMスクリプトアノテーション、音声クローン、音声デザイン、LoRAトレーニング、行ごとのスタイル制御、MP3・章付きM4B・Audacityマルチトラックへのエクスポート。Qwen3-TTSをベースに構築。
★ 999+17直近 7 日のスター増減 - #29
感情、話し方、パラ言語の編集に優れ、堅牢なゼロショットTTS機能を備えた、強力な3BパラメータのLLMベース強化学習オーディオ編集モデル
★ 972+1直近 7 日のスター増減 - #30
システム全体でのシームレスな音声クローンと高忠実度なテキスト読み上げを可能にする、軽量なオフライン Android Text-to-Speech (TTS) エンジン。
★ 803+2直近 7 日のスター増減