跳到主要内容
buildradar
登录
主题 · speech-synthesis

speech-synthesis

标记 speech-synthesis 主题、收录中的开源项目,按星标数排序。

项目数
66
总星标数
348,104
平均星标数
5,274
占比
0.02%

常跟 speech-synthesis 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 speech-synthesis 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • TTS@coqui-ai

    🐸💬 - 用于文字转语音的深度学习工具包,已在研究与生产环境中验证

    45,985+0近 7 天星标变化
  • VoxCPM@OpenBMB

    VoxCPM2:无需分词器的多语言语音生成、创意语音设计与真实感克隆

    36,595+0近 7 天星标变化
  • Speech@NVIDIA-NeMo

    为研究人员与开发者打造的可扩展生成式 AI 框架,支持大型语言模型、多模态与语音 AI(自动语音识别与文本转语音)

    18,379+0近 7 天星标变化
  • leon@leon-ai

    🧠 Leon 是你的开源个人助理

    17,476+0近 7 天星标变化
  • DeepLearningExamples@NVIDIA

    最先进的深度学习脚本,按模型组织,易于训练和部署,在企业级基础设施上提供可重现的准确度和性能。

    14,846+0近 7 天星标变化
  • supertonic@supertone-inc

    闪电般快速、在设备上运行的多语言 TTS —— 通过 ONNX 原生运行

    13,757+0近 7 天星标变化
  • speech-to-speech@huggingface

    使用开源模型构建语音代理

    13,015+0近 7 天星标变化
  • voice-pro@abus-aikorea

    Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译

    12,730+0近 7 天星标变化
  • PaddleSpeech@PaddlePaddle

    易用的语音工具包,包含自监督学习模型、SOTA/流式 ASR(含标点)、流式 TTS(含文字前端)、说话者验证系统、端到端语音翻译与关键词检测。荣获 NAACL2022 最佳示范奖

    12,676+0近 7 天星标变化
  • edge-tts@rany2

    在 Python 中使用 Microsoft Edge 的在线文字转语音服务,无需 Microsoft Edge、Windows 或 API 密钥

    11,847+0近 7 天星标变化
  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)是一个音频、音乐和语音生成工具箱,旨在支持可重复研究,帮助初学者和工程师快速进入音频、音乐和语音生成的研发领域。

    10,276+0近 7 天星标变化
  • espnet@espnet

    端到端语音处理工具包

    9,949+0近 7 天星标变化
  • so-vits-svc-fork@voicepaw

    so-vits-svc 分支,支持实时功能、改进界面与更多特性

    9,329+0近 7 天星标变化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多语音与提示控制的文字转语音引擎

    8,522+0近 7 天星标变化
  • mlx-audio@Blaizzy

    一个基于 Apple MLX 框架的文字转语音(TTS)、语音转文字(STT)与语音转语音(STS)库,提供在 Apple Silicon 上高效的语音分析。

    7,826+0近 7 天星标变化
  • espeak-ng@espeak-ng

    eSpeak NG 是支持超过百种语言与口音的开源语音合成器

    6,802+0近 7 天星标变化
  • StyleTTS2@yl4579

    StyleTTS 2:通过风格扩散与对抗训练,结合大型语音语言模型,迈向人类水平的文本转语音

    6,342+0近 7 天星标变化
  • silero-models@snakers4

    Silero 模型:让预训练文字转语音模型变得极度简单

    6,084+0近 7 天星标变化
  • abogen@denizsafak

    从 EPUB、PDF 和文本生成带同步字幕的有声书。

    5,831+0近 7 天星标变化
  • DiffSinger@MoonInTheRiver

    DiffSinger:通过浅层扩散机制的歌声合成(SVS & TTS);AAAI 2022;官方代码

    4,855+0近 7 天星标变化
  • WhisperSpeech@WhisperSpeech

    一个开源的文字转语音系统,通过反向 Whisper 构建

    4,645+0近 7 天星标变化
  • OpenUtau@openutau

    开放式歌唱合成平台 / 开源 UTAU 继任者

    4,258+0近 7 天星标变化
  • metavoice-src@metavoiceio

    面向人类般表达式TTS的基础模型

    4,203+0近 7 天星标变化
  • RealtimeTTS@KoljaB

    Converts text to speech in realtime

    4,021+0近 7 天星标变化
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS:Tensorflow 2 的实时最先进语音合成(支持英语、法语、韩语、中文、德语,易于扩展至其他语言)

    3,996+0近 7 天星标变化
  • lingvo@tensorflow

    Lingvo

    2,864+0近 7 天星标变化
  • MARS5-TTS@Camb-ai

    来自 CAMB.AI 的 MARS5 语音模型 (TTS)

    2,818+0近 7 天星标变化
  • marytts@marytts

    MARY TTS -- 一个以纯 Java 编写的开源多语言文字转语音合成系统

    2,583+0近 7 天星标变化
  • VieNeu-TTS@pnnbao97

    具备实时语音复制功能的越南语 TTS • 设备端 • 实时 CPU 推理 • 24kHz 音频质量 • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2,468+0近 7 天星标变化
  • hifi-gan@jik876

    HiFi-GAN:用于高效且高保真语音合成的生成对抗网络

    2,367+0近 7 天星标变化
← 返回主题列表