voice-cloning
標記 voice-cloning 主題、收錄中的開源專案,依星數排序。
- #31
即時語音助理 —— WebRTC 串流、faster-whisper ASR、本地 LLM、Vui Nano (300M) TTS。相容 OpenAI Realtime API。支援語音複製、插話打斷,在 4090 上約有 9 倍即時效能。採用 Apache 2.0 授權。
★ 760+7近 7 天星數變化 - #32
MimikaStudio - 適用於 macOS (Apple Silicon) 的本機優先應用程式 + 支援 Agentic MCP
★ 736+4近 7 天星數變化 - #33
使用 Chatterbox 的本地、相容 OpenAI 的文字轉語音 (TTS) API,讓使用者能在任何使用 OpenAI API 的地方產生語音複製內容(例如 Open WebUI、AnythingLLM 等)
★ 677+1近 7 天星數變化 - #34
將 PDF 與 EPUB 轉為有聲書;將字幕或影片轉為配音影片(包含翻譯)等等。完全免費。Pandrator 使用本機模型,包含語音複製(即時、RVC 強化、XTTS 微調)與 LLM 處理。期許成為一個具備圖形介面、安裝程式與一體化套件的使用者友善應用程式。
★ 622+3近 7 天星數變化 - #35
YouDub 是一個開源工具,旨在自動化地將優質的 YouTube 影片進行翻譯和配音,以便將其搬運到中文互聯網上。該工具使用了 AI 語音識別技術將音訊轉換為文字,然後透過大語言模型將文字翻譯成中文,最後透過 AI 聲音複製技術將中文轉換為音訊。這樣,我們就可以創建出具有原始 YouTuber 音色的中文配音影片。
★ 615-1近 7 天星數變化 - #36
用於 VibeVoice TTS 的 ComfyUI 自訂節點。具備表現力、長文本、多語者對話語音功能
★ 596-1近 7 天星數變化 - #37
Chatterbox 的修改版本,支援文字檔輸入且無字元限制。我用它來製作有聲書,特別是給孩子們聽的。
★ 575-1近 7 天星數變化 - #38
在 Mac (M1/M2/M3/M4) 上本地執行 Qwen3-TTS 文字轉語音。支援語音複製、語音設計與自訂語音,使用 MLX 實現 100% 離線運作
★ 561+2近 7 天星數變化 - #39
全球首款具備個人化語音複製功能的開源即時端對端語音對話模型。
★ 550+1近 7 天星數變化 - #40
ComfyUI 的 OmniVoice TTS 節點 - 支援語音複製、語音設計與多說話者對話的零樣本多語言文字轉語音技術
★ 547+6近 7 天星數變化 - #41
用於高表現力語音與真實零樣本語音複製的 ComfyUI 節點
★ 509+0近 7 天星數變化