跳到主要內容
buildradar
登入
主題 · voice-cloning

voice-cloning

標記 voice-cloning 主題、收錄中的開源專案,依星數排序。

專案數
41
總星數
355,522
平均星數
8,671
佔比
0.02%

常跟 voice-cloning 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 voice-cloning 主題的專案。

  • audio.cpp@0xShug0

    一款由 ggml 驅動的一體化純 C++ 音訊模型推理引擎。支援 TTS、STT、VAD、語音轉換、音樂生成等功能,具備高度優化的效能,無需依賴 Python。

    2,214
  • GPT-SoVITS@RVC-Boss

    1 分鐘的語音資料也能用來訓練高品質的 TTS 模型!(少量樣本語音克隆)

    61,476+0近 7 天星數變化
  • 在 5 秒內克隆聲音,實時產生任意語音

    60,117+0近 7 天星數變化
  • TTS@coqui-ai

    🐸💬 - 用於文字轉語音的深度學習工具包,已在研究與生產環境中驗證

    45,985+0近 7 天星數變化
  • VoxCPM@OpenBMB

    VoxCPM2:無需分詞器的多語言語音合成、創意語音設計與真實感克隆

    36,595+0近 7 天星數變化
  • CosyVoice@QwenAudio

    多語言大型語音生成模型,提供推論、訓練與部署全端能力

    23,426+0近 7 天星數變化
  • ebook2audiobook@DrewThomasson

    將電子書轉為有聲書,支援語音克隆與 1158 種以上語言!

    20,097+0近 7 天星數變化
  • VideoLingo@Huanshere

    Netflix 級別的字幕切割、翻譯、對齊,甚至配音,一鍵全自動 AI 影片字幕團隊

    18,339+0近 7 天星數變化
  • VoiceStudio@debpalash

    VoiceStudio 是開源、完全本地化的 ElevenLabs 替代方案——支援 646 種語言的語音克隆、語音設計、影片配音、口述、轉錄與有聲書製作。

    14,835+0近 7 天星數變化
  • voice-pro@abus-aikorea

    Gradio WebUI 為創作者與開發者提供關鍵 TTS(Edge‑TTS、kokoro)與零樣本語音克隆(E2 & F5‑TTS、CosyVoice),並支援 Whisper 音訊處理、YouTube 下載、Demucs 人聲分離與多語言翻譯

    12,730+0近 7 天星數變化
  • PaddleSpeech@PaddlePaddle

    易用的語音工具包,包含自監督學習模型、SOTA/串流 ASR(含標點)、串流 TTS(含文字前端)、說話者驗證系統、端到端語音翻譯與關鍵詞偵測。榮獲 NAACL2022 最佳示範獎

    12,676+0近 7 天星數變化
  • YuE@multimodal-art-projection

    YuE:開放式全曲音樂生成基礎模型,類似 Suno.ai 但開源

    6,416+0近 7 天星數變化
  • YouDub-webui@liuzhao1225

    開源 AI 視頻本地化工具:自動完成 YouTube/Bilibili 視頻下載、字幕識別與翻譯、語音克隆配音、音軌混合與字幕壓縮。

    5,404+0近 7 天星數變化
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family 是 MOSI.AI 與 OpenMOSS 團隊開源的語音與聲音生成模型族,設計用於高保真度、高表現力與複雜實際場景,涵蓋穩定長篇語音、多說話者對話、聲音/角色設計、環境音效與即時串流 TTS

    4,058+0近 7 天星數變化
  • Applio@IAHispano

    A simple, high-quality voice conversion tool focused on ease of use and performance.

    3,674+0近 7 天星數變化
  • MARS5-TTS@Camb-ai

    來自 CAMB.AI 的 MARS5 語音模型 (TTS)

    2,818+0近 7 天星數變化
  • audio.cpp@0xShug0

    一款由 ggml 驅動的一體化純 C++ 音訊模型推理引擎。支援 TTS、STT、VAD、語音轉換、音樂生成等功能,具備高度優化的效能,無需依賴 Python。

    2,214+0近 7 天星數變化
  • Genie-TTS@High-Logic

    GPT-SoVITS ONNX 推理引擎與模型轉換器

    1,760+0近 7 天星數變化
  • MiniMax-MCP@MiniMax-AI

    官方 MiniMax Model Context Protocol (MCP) 伺服器,可與強大的文字轉語音、影像生成和影片生成 API 進行互動。

    1,573+0近 7 天星數變化
  • VibeVoice-ComfyUI@Enemyx-net

    適用於 Microsoft VibeVoice 文字轉語音模型的完整 ComfyUI 整合,讓您能在 ComfyUI 工作流程中直接進行高品質的單人與多人語音合成。

    1,555+0近 7 天星數變化
  • Voice-Cloning-App@voice-cloning-app

    用於輕鬆合成人聲的 Python/PyTorch 應用程式

    1,440+0近 7 天星數變化
  • 自架強大的 Chatterbox TTS 模型。此伺服器提供使用者友善的 Web UI、靈活的 API 端點(包含相容 OpenAI)、預定義語音、語音複製,以及大型有聲書規模的文字處理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速執行。

    1,427+0近 7 天星數變化
  • 💎 適用於 ASR、TTS 及其他語音技術的無障礙語音語料庫清單

    1,399+0近 7 天星數變化
  • Twocast@panyanyany

    雙語集數的 AI Podcast 生成器,支援多語言,NotebookLLM 的替代方案;真人對話 AI 播客生成器,多語言,多音色

    1,289+0近 7 天星數變化
  • audio-webui@gitmylo

    一個用於各種音訊相關神經網路的 WebUI

    1,246+0近 7 天星數變化
  • Irodori-TTS@Aratako

    基於 Flow Matching 且支援 Emoji 驅動風格控制的文字轉語音模型

    1,228+0近 7 天星數變化
  • TTS-Audio-Suite@diodiogod

    一個 ComfyUI 自訂節點整合套件,用於本機多引擎、多語言文字轉語音與語音轉換。支援:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(經典與多語言)、F5-TTS、Higgs Audio 2、3 與 VibeVoice,具備無限文字長度、SRT 計時、角色支援及多種音訊工具

    1,187+0近 7 天星數變化
  • mlx-serve@ddalcu

    適用於 Apple Silicon 的原生 LLM 推論伺服器。相容 OpenAI + Anthropic API。無須 Python。包含具備聊天、agent 模式與工具呼叫功能的 MLX Core macOS 應用程式。

    1,115+39近 7 天星數變化
  • alexandria-audiobook@Finrandojin

    AI 驅動的多語音有聲書產生器 — LLM 腳本註解、語音複製、語音設計、LoRA 訓練、逐行風格控制,以及匯出為 MP3、分章 M4B 或 Audacity 多軌。基於 Qwen3-TTS 構建。

    1,000+10近 7 天星數變化
  • Step-Audio-EditX@stepfun-ai

    強大的 3B 參數、基於 LLM 的強化學習音訊編輯模型,擅長編輯情感、說話風格與副語言學,並具備強大的零樣本文字轉語音功能

    973+1近 7 天星數變化
  • CloneTTS@sipeter

    執行於 Android 本地的輕量級文字轉語音 (TTS) 引擎,支援無縫的系統級全域語音複製與高傳真文字朗讀。

    804+5近 7 天星數變化
← 返回主題列表