voice-cloning
标记 voice-cloning 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 voice-cloning 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 voice-cloning 主题的项目。
- #1
1 分钟的语音数据也能用来训练高质量的 TTS 模型!(少量样本语音克隆)
★ 61,476+0近 7 天星标变化 - #2
在 5 秒内克隆声音,实时生成任意语音
★ 60,117+0近 7 天星标变化 - #3★ 45,985+0近 7 天星标变化
- #4★ 36,595+0近 7 天星标变化
- #5★ 23,426+0近 7 天星标变化
- #6
从电子书生成有声书,支持语音克隆和 1158+ 种语言!
★ 20,097+0近 7 天星标变化 - #7
Netflix 级别的字幕切割、翻译、对齐,甚至配音,一键全自动 AI 视频字幕团队
★ 18,339+0近 7 天星标变化 - #8
VoiceStudio 是开源、完全本地化的 ElevenLabs 替代方案——支持 646 种语言的语音克隆、语音设计、视频配音、口述、转录与有声书制作。
★ 14,835+0近 7 天星标变化 - #9
Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译
★ 12,730+0近 7 天星标变化 - #10
易用的语音工具包,包含自监督学习模型、SOTA/流式 ASR(含标点)、流式 TTS(含文字前端)、说话者验证系统、端到端语音翻译与关键词检测。荣获 NAACL2022 最佳示范奖
★ 12,676+0近 7 天星标变化 - #11★ 6,416+0近 7 天星标变化
- #12
开源 AI 视频本地化工具:自动完成 YouTube/Bilibili 视频下载、字幕识别与翻译、语音克隆配音、音轨混合与字幕压缩。
★ 5,404+0近 7 天星标变化 - #13
MOSS‑TTS Family 是 MOSI.AI 与 OpenMOSS 团队开源的语音与声音生成模型族,设计用于高保真度、高表现力与复杂实际场景,涵盖稳定长篇语音、多说话者对话、声音/角色设计、环境音效与实时串流 TTS
★ 4,058+0近 7 天星标变化 - #14
A simple, high-quality voice conversion tool focused on ease of use and performance.
★ 3,674+0近 7 天星标变化 - #15★ 2,818+0近 7 天星标变化
- #16★ 2,214+0近 7 天星标变化
- #17★ 1,760+0近 7 天星标变化
- #18
官方 MiniMax Model Context Protocol (MCP) 服务器,可与强大的文本转语音、图像生成和视频生成 API 进行交互。
★ 1,573+0近 7 天星标变化 - #19
适用于 Microsoft VibeVoice 文本转语音模型的完整 ComfyUI 集成,让您能在 ComfyUI 工作流程中直接进行高质量的单人与多人语音合成。
★ 1,555+0近 7 天星标变化 - #20
用于轻松合成人声的 Python/PyTorch 应用程序
★ 1,440+0近 7 天星标变化 - #21
自架强大的 Chatterbox TTS 模型。此服务器提供用户友好的 Web UI、灵活的 API 端点(包含兼容 OpenAI)、预定义语音、语音克隆,以及大型有声书规模的文本处理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速运行。
★ 1,427+0近 7 天星标变化 - #22
💎 适用于 ASR、TTS 及其他语音技术的无障碍语音语料库列表
★ 1,399+0近 7 天星标变化 - #23★ 1,289+0近 7 天星标变化
- #24
一个用于各种音频相关神经网络的 WebUI
★ 1,246+0近 7 天星标变化 - #25
基于 Flow Matching 且支持 Emoji 驱动风格控制的文本转语音模型
★ 1,228+0近 7 天星标变化 - #26
一个 ComfyUI 自定义节点集成套件,用于本地多引擎、多语言文本转语音与语音转换。支持:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(经典与多语言)、F5-TTS、Higgs Audio 2、3 与 VibeVoice,具备无限文本长度、SRT 计时、角色支持及多种音频工具
★ 1,187+0近 7 天星标变化 - #27
适用于 Apple Silicon 的原生 LLM 推理服务器。兼容 OpenAI + Anthropic API。无 Python。包含带聊天、agent 模式和工具调用功能的 MLX Core macOS 应用。
★ 1,115+39近 7 天星标变化 - #28
AI 驱动的多语音有声书生成器 — LLM 脚本注解、语音复制、语音设计、LoRA 训练、逐行风格控制,以及导出为 MP3、分章 M4B 或 Audacity 多轨。基于 Qwen3-TTS 构建。
★ 1,000+10近 7 天星标变化 - #29
强大的 3B 参数、基于 LLM 的强化学习音频编辑模型,擅长编辑情感、说话风格与副语言学,并具备强大的零样本文本转语音功能
★ 973+1近 7 天星标变化 - #30★ 804+5近 7 天星标变化