跳到主要内容
buildradar
登录
主题 · voice-cloning

voice-cloning

标记 voice-cloning 主题、收录中的开源项目,按星标数排序。

项目数
41
总星标数
355,522
平均星标数
8,671
占比
0.02%

常跟 voice-cloning 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 voice-cloning 主题的项目。

  • audio.cpp@0xShug0

    一款由 ggml 驱动的一体化纯 C++ 音频模型推理引擎。支持 TTS、STT、VAD、语音转换、音乐生成等功能,具备高度优化的性能,无 Python 依赖。

    2,214
  • GPT-SoVITS@RVC-Boss

    1 分钟的语音数据也能用来训练高质量的 TTS 模型!(少量样本语音克隆)

    61,476+0近 7 天星标变化
  • 在 5 秒内克隆声音,实时生成任意语音

    60,117+0近 7 天星标变化
  • TTS@coqui-ai

    🐸💬 - 用于文字转语音的深度学习工具包,已在研究与生产环境中验证

    45,985+0近 7 天星标变化
  • VoxCPM@OpenBMB

    VoxCPM2:无需分词器的多语言语音生成、创意语音设计与真实感克隆

    36,595+0近 7 天星标变化
  • CosyVoice@QwenAudio

    多语言大型语音生成模型,提供推理、训练与部署全栈能力

    23,426+0近 7 天星标变化
  • ebook2audiobook@DrewThomasson

    从电子书生成有声书,支持语音克隆和 1158+ 种语言!

    20,097+0近 7 天星标变化
  • VideoLingo@Huanshere

    Netflix 级别的字幕切割、翻译、对齐,甚至配音,一键全自动 AI 视频字幕团队

    18,339+0近 7 天星标变化
  • VoiceStudio@debpalash

    VoiceStudio 是开源、完全本地化的 ElevenLabs 替代方案——支持 646 种语言的语音克隆、语音设计、视频配音、口述、转录与有声书制作。

    14,835+0近 7 天星标变化
  • voice-pro@abus-aikorea

    Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译

    12,730+0近 7 天星标变化
  • PaddleSpeech@PaddlePaddle

    易用的语音工具包,包含自监督学习模型、SOTA/流式 ASR(含标点)、流式 TTS(含文字前端)、说话者验证系统、端到端语音翻译与关键词检测。荣获 NAACL2022 最佳示范奖

    12,676+0近 7 天星标变化
  • YuE@multimodal-art-projection

    YuE:开放式全曲音乐生成基础模型,类似 Suno.ai 但开源

    6,416+0近 7 天星标变化
  • YouDub-webui@liuzhao1225

    开源 AI 视频本地化工具:自动完成 YouTube/Bilibili 视频下载、字幕识别与翻译、语音克隆配音、音轨混合与字幕压缩。

    5,404+0近 7 天星标变化
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family 是 MOSI.AI 与 OpenMOSS 团队开源的语音与声音生成模型族,设计用于高保真度、高表现力与复杂实际场景,涵盖稳定长篇语音、多说话者对话、声音/角色设计、环境音效与实时串流 TTS

    4,058+0近 7 天星标变化
  • Applio@IAHispano

    A simple, high-quality voice conversion tool focused on ease of use and performance.

    3,674+0近 7 天星标变化
  • MARS5-TTS@Camb-ai

    来自 CAMB.AI 的 MARS5 语音模型 (TTS)

    2,818+0近 7 天星标变化
  • audio.cpp@0xShug0

    一款由 ggml 驱动的一体化纯 C++ 音频模型推理引擎。支持 TTS、STT、VAD、语音转换、音乐生成等功能,具备高度优化的性能,无 Python 依赖。

    2,214+0近 7 天星标变化
  • Genie-TTS@High-Logic

    GPT-SoVITS ONNX 推理引擎与模型转换器

    1,760+0近 7 天星标变化
  • MiniMax-MCP@MiniMax-AI

    官方 MiniMax Model Context Protocol (MCP) 服务器,可与强大的文本转语音、图像生成和视频生成 API 进行交互。

    1,573+0近 7 天星标变化
  • VibeVoice-ComfyUI@Enemyx-net

    适用于 Microsoft VibeVoice 文本转语音模型的完整 ComfyUI 集成,让您能在 ComfyUI 工作流程中直接进行高质量的单人与多人语音合成。

    1,555+0近 7 天星标变化
  • Voice-Cloning-App@voice-cloning-app

    用于轻松合成人声的 Python/PyTorch 应用程序

    1,440+0近 7 天星标变化
  • 自架强大的 Chatterbox TTS 模型。此服务器提供用户友好的 Web UI、灵活的 API 端点(包含兼容 OpenAI)、预定义语音、语音克隆,以及大型有声书规模的文本处理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速运行。

    1,427+0近 7 天星标变化
  • 💎 适用于 ASR、TTS 及其他语音技术的无障碍语音语料库列表

    1,399+0近 7 天星标变化
  • Twocast@panyanyany

    双语集数的 AI Podcast 生成器,支持多语言,NotebookLLM 的替代方案;真人对话 AI 播客生成器,多语言,多音色

    1,289+0近 7 天星标变化
  • audio-webui@gitmylo

    一个用于各种音频相关神经网络的 WebUI

    1,246+0近 7 天星标变化
  • Irodori-TTS@Aratako

    基于 Flow Matching 且支持 Emoji 驱动风格控制的文本转语音模型

    1,228+0近 7 天星标变化
  • TTS-Audio-Suite@diodiogod

    一个 ComfyUI 自定义节点集成套件,用于本地多引擎、多语言文本转语音与语音转换。支持:RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(经典与多语言)、F5-TTS、Higgs Audio 2、3 与 VibeVoice,具备无限文本长度、SRT 计时、角色支持及多种音频工具

    1,187+0近 7 天星标变化
  • mlx-serve@ddalcu

    适用于 Apple Silicon 的原生 LLM 推理服务器。兼容 OpenAI + Anthropic API。无 Python。包含带聊天、agent 模式和工具调用功能的 MLX Core macOS 应用。

    1,115+39近 7 天星标变化
  • alexandria-audiobook@Finrandojin

    AI 驱动的多语音有声书生成器 — LLM 脚本注解、语音复制、语音设计、LoRA 训练、逐行风格控制,以及导出为 MP3、分章 M4B 或 Audacity 多轨。基于 Qwen3-TTS 构建。

    1,000+10近 7 天星标变化
  • Step-Audio-EditX@stepfun-ai

    强大的 3B 参数、基于 LLM 的强化学习音频编辑模型,擅长编辑情感、说话风格与副语言学,并具备强大的零样本文本转语音功能

    973+1近 7 天星标变化
  • CloneTTS@sipeter

    运行在安卓本地的轻量级文字转语音 (TTS) 引擎,支持离线发音人提取、零门槛音色克隆与双擎系统级全局听书。

    804+5近 7 天星标变化
← 返回主题列表