voice-cloning
標記 voice-cloning 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 voice-cloning 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 voice-cloning 主題的專案。
- #1
1 分鐘的語音資料也能用來訓練高品質的 TTS 模型!(少量樣本語音克隆)
★ 61,476+0近 7 天星數變化 - #2
在 5 秒內克隆聲音,實時產生任意語音
★ 60,117+0近 7 天星數變化 - #3★ 45,985+0近 7 天星數變化
- #4★ 36,595+0近 7 天星數變化
- #5★ 23,426+0近 7 天星數變化
- #6
將電子書轉為有聲書,支援語音克隆與 1158 種以上語言!
★ 20,097+0近 7 天星數變化 - #7
Netflix 級別的字幕切割、翻譯、對齊,甚至配音,一鍵全自動 AI 影片字幕團隊
★ 18,339+0近 7 天星數變化 - #8
VoiceStudio 是開源、完全本地化的 ElevenLabs 替代方案——支援 646 種語言的語音克隆、語音設計、影片配音、口述、轉錄與有聲書製作。
★ 14,835+0近 7 天星數變化 - #9
Gradio WebUI 為創作者與開發者提供關鍵 TTS(Edge‑TTS、kokoro)與零樣本語音克隆(E2 & F5‑TTS、CosyVoice),並支援 Whisper 音訊處理、YouTube 下載、Demucs 人聲分離與多語言翻譯
★ 12,730+0近 7 天星數變化 - #10
易用的語音工具包,包含自監督學習模型、SOTA/串流 ASR(含標點)、串流 TTS(含文字前端)、說話者驗證系統、端到端語音翻譯與關鍵詞偵測。榮獲 NAACL2022 最佳示範獎
★ 12,676+0近 7 天星數變化 - #11★ 6,416+0近 7 天星數變化
- #12
開源 AI 視頻本地化工具:自動完成 YouTube/Bilibili 視頻下載、字幕識別與翻譯、語音克隆配音、音軌混合與字幕壓縮。
★ 5,404+0近 7 天星數變化 - #13
MOSS‑TTS Family 是 MOSI.AI 與 OpenMOSS 團隊開源的語音與聲音生成模型族,設計用於高保真度、高表現力與複雜實際場景,涵蓋穩定長篇語音、多說話者對話、聲音/角色設計、環境音效與即時串流 TTS
★ 4,058+0近 7 天星數變化 - #14
A simple, high-quality voice conversion tool focused on ease of use and performance.
★ 3,674+0近 7 天星數變化 - #15★ 2,818+0近 7 天星數變化
- #16★ 2,214+0近 7 天星數變化
- #17★ 1,760+0近 7 天星數變化
- #18
官方 MiniMax Model Context Protocol (MCP) 伺服器,可與強大的文字轉語音、影像生成和影片生成 API 進行互動。
★ 1,573+0近 7 天星數變化 - #19
適用於 Microsoft VibeVoice 文字轉語音模型的完整 ComfyUI 整合,讓您能在 ComfyUI 工作流程中直接進行高品質的單人與多人語音合成。
★ 1,555+0近 7 天星數變化 - #20
用於輕鬆合成人聲的 Python/PyTorch 應用程式
★ 1,440+0近 7 天星數變化 - #21
自架強大的 Chatterbox TTS 模型。此伺服器提供使用者友善的 Web UI、靈活的 API 端點(包含相容 OpenAI)、預定義語音、語音複製,以及大型有聲書規模的文字處理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速執行。
★ 1,427+0近 7 天星數變化 - #22
💎 適用於 ASR、TTS 及其他語音技術的無障礙語音語料庫清單
★ 1,399+0近 7 天星數變化 - #23★ 1,289+0近 7 天星數變化
- #24
一個用於各種音訊相關神經網路的 WebUI
★ 1,246+0近 7 天星數變化 - #25
基於 Flow Matching 且支援 Emoji 驅動風格控制的文字轉語音模型
★ 1,228+0近 7 天星數變化 - #26
一個 ComfyUI 自訂節點整合套件,用於本機多引擎、多語言文字轉語音與語音轉換。支援:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(經典與多語言)、F5-TTS、Higgs Audio 2、3 與 VibeVoice,具備無限文字長度、SRT 計時、角色支援及多種音訊工具
★ 1,187+0近 7 天星數變化 - #27
適用於 Apple Silicon 的原生 LLM 推論伺服器。相容 OpenAI + Anthropic API。無須 Python。包含具備聊天、agent 模式與工具呼叫功能的 MLX Core macOS 應用程式。
★ 1,115+39近 7 天星數變化 - #28
AI 驅動的多語音有聲書產生器 — LLM 腳本註解、語音複製、語音設計、LoRA 訓練、逐行風格控制,以及匯出為 MP3、分章 M4B 或 Audacity 多軌。基於 Qwen3-TTS 構建。
★ 1,000+10近 7 天星數變化 - #29
強大的 3B 參數、基於 LLM 的強化學習音訊編輯模型,擅長編輯情感、說話風格與副語言學,並具備強大的零樣本文字轉語音功能
★ 973+1近 7 天星數變化 - #30★ 804+5近 7 天星數變化