メインコンテンツへスキップ
buildradar
Sign in
トピック · voice-cloning

voice-cloning

voice-cloning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
41
総スター数
355,522
平均スター数
8,671
シェア
0.02%

voice-cloning と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、voice-cloning がタグ付けされたリポジトリ。

  • audio.cpp@0xShug0

    ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。

    2,214
  • GPT-SoVITS@RVC-Boss

    1分の音声データでも優れたTTSモデルのトレーニングに使用可能!(Few-shotボイスクローニング)

    61,476+138直近 7 日のスター増減
  • 5秒で音声をクローンし、任意の音声をリアルタイムで生成

    60,117-4直近 7 日のスター増減
  • TTS@coqui-ai

    🐸💬 - 研究および本番環境で実証済みの Text-to-Speech 用ディープラーニングツールキット

    45,985+18直近 7 日のスター増減
  • VoxCPM@OpenBMB

    VoxCPM2: 多言語音声生成、クリエイティブなボイスデザイン、真実味のあるクローニングのためのトークナイザーフリーTTS

    36,595+345直近 7 日のスター増減
  • CosyVoice@QwenAudio

    推論、学習、デプロイのフルスタック機能を備えた多言語大規模音声生成モデル

    23,426+359直近 7 日のスター増減
  • ebook2audiobook@DrewThomasson

    電子書籍からオーディオブックを生成、ボイスクローニング&1158以上の言語に対応!

    20,097+34直近 7 日のスター増減
  • VideoLingo@Huanshere

    Netflixレベルの字幕カット、翻訳、アライメント、さらにはダビングまで対応 - ワンクリックで完全自動化されるAI動画字幕チーム | Netflix級の字幕カット、翻訳、アライメント、さらには吹き替えまで、ワンクリックで完全自動化されるAI字幕チーム

    18,339+49直近 7 日のスター増減
  • VoiceStudio@debpalash

    VoiceStudioは、完全にローカルで動作するオープンソースのElevenLabs代替ツールです。646言語で音声クローニング、音声デザイン、ビデオダビング、ディクテーション、文字起こし、オーディオブック作成に対応しています。

    14,835+2,880直近 7 日のスター増減
  • voice-pro@abus-aikorea

    クリエイターと開発者のためのGradio WebUI。主要なTTS (Edge-TTS, kokoro) およびゼロショット音声クローニング (E2 & F5-TTS, CosyVoice) を特徴とし、Whisperオーディオ処理、YouTubeダウンロード、Demucsによるボーカル分離、多言語翻訳に対応。

    12,730+54直近 7 日のスター増減
  • PaddleSpeech@PaddlePaddle

    自己教師あり学習モデル、句読点付きSOTA/ストリーミングASR、テキストフロントエンド付きストリーミングTTS、話者認証システム、エンドツーエンド音声翻訳、キーワードスポッティングを含む使いやすい音声ツールキット。NAACL2022最優秀デモ賞を受賞。

    12,676+5直近 7 日のスター増減
  • YuE@multimodal-art-projection

    YuE: Suno.aiに似たオープンなフルソング音楽生成基盤モデル

    6,416+8直近 7 日のスター増減
  • YouDub-webui@liuzhao1225

    オープンソースのAI動画ローカライゼーションツール:YouTube/Bilibili動画のダウンロード、字幕認識と翻訳、音声クローン吹き替え、音源ミキシング、字幕エンコードを自動実行。

    5,404+25直近 7 日のスター増減
  • MOSS-TTS@OpenMOSS

    MOSS‑TTSファミリーは、MOSI.AIとOpenMOSSチームによるオープンソースの音声・音響生成モデルファミリーです。高忠実度、高表現力、複雑な実世界シナリオ向けに設計されており、安定した長尺音声、マルチスピーカー対話、ボイス/キャラクターデザイン、環境音エフェクト、リアルタイムストリーミングTTSを網羅しています。

    4,058+18直近 7 日のスター増減
  • Applio@IAHispano

    使いやすさとパフォーマンスに重点を置いた、シンプルで高品質な音声変換ツール

    3,674+14直近 7 日のスター増減
  • MARS5-TTS@Camb-ai

    CAMB.AI の MARS5 音声モデル (TTS)

    2,818+1直近 7 日のスター増減
  • audio.cpp@0xShug0

    ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。

    2,214+115直近 7 日のスター増減
  • Genie-TTS@High-Logic

    GPT-SoVITS ONNX推論エンジンおよびモデルコンバーター

    1,760+3直近 7 日のスター増減
  • MiniMax-MCP@MiniMax-AI

    強力な音声合成、画像生成、動画生成 API との連携を可能にする公式 MiniMax Model Context Protocol (MCP) サーバー

    1,573+2直近 7 日のスター増減
  • VibeVoice-ComfyUI@Enemyx-net

    MicrosoftのVibeVoice音声合成モデル向けの包括的なComfyUI統合。ComfyUIのワークフロー内で直接、高品質なシングルおよびマルチスピーカーの音声合成を実現します。

    1,555+4直近 7 日のスター増減
  • Voice-Cloning-App@voice-cloning-app

    人間の声を簡単に合成するための Python/PyTorch アプリケーション

    1,440+0直近 7 日のスター増減
  • 強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。

    1,427+1直近 7 日のスター増減
  • 💎 ASR、TTS、その他の音声技術向けにアクセス可能な音声コーパスのリスト

    1,399+0直近 7 日のスター増減
  • Twocast@panyanyany

    バイリンガルエピソード、多言語に対応した AI ポッドキャストジェネレーター。NotebookLLM の代替としても利用可能

    1,289-1直近 7 日のスター増減
  • audio-webui@gitmylo

    様々な音声関連のNeural Network向けWebUI

    1,246+0直近 7 日のスター増減
  • Irodori-TTS@Aratako

    絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル

    1,228+4直近 7 日のスター増減
  • TTS-Audio-Suite@diodiogod

    ローカルでのマルチエンジン・多言語の音声合成(TTS)および音声変換を行うためのComfyUIカスタムノード統合。RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(クラシックおよび多言語)、F5-TTS、Higgs Audio 2、3、VibeVoiceをサポートし、無制限のテキスト長、SRTタイミング、キャラクターサポート、および多数のオーディオツールを備えています。

    1,187+7直近 7 日のスター増減
  • mlx-serve@ddalcu

    Apple Silicon向けのネイティブLLM推論サーバー。OpenAIおよびAnthropic API互換。Python不要。チャット、エージェントモード、ツール呼び出し機能を備えたMLX Core macOSアプリを同梱。

    1,115+245直近 7 日のスター増減
  • alexandria-audiobook@Finrandojin

    AIを活用したマルチボイスオーディオブックジェネレーター — LLMスクリプトアノテーション、音声クローン、音声デザイン、LoRAトレーニング、行ごとのスタイル制御、MP3・章付きM4B・Audacityマルチトラックへのエクスポート。Qwen3-TTSをベースに構築。

    999+17直近 7 日のスター増減
  • Step-Audio-EditX@stepfun-ai

    感情、話し方、パラ言語の編集に優れ、堅牢なゼロショットTTS機能を備えた、強力な3BパラメータのLLMベース強化学習オーディオ編集モデル

    972+1直近 7 日のスター増減
  • CloneTTS@sipeter

    システム全体でのシームレスな音声クローンと高忠実度なテキスト読み上げを可能にする、軽量なオフライン Android Text-to-Speech (TTS) エンジン。

    803+2直近 7 日のスター増減
← トピック一覧に戻る