跳到主要内容
buildradar
登录
主题 · speech-synthesis

speech-synthesis

标记 speech-synthesis 主题、收录中的开源项目,按星标数排序。

共 66 个项目
  • chat-with-gpt@cogentapps

    一个具备语音功能的开源 ChatGPT 应用程序

    2,350+0近 7 天星标变化
  • IMS-Toucan@DigitalPhonetics

    支持超过 7000 种语言、可控制且快速的文字转语音!

    2,207+0近 7 天星标变化
  • RHVoice@RHVoice

    一个用于俄语和其他语言的免费开源语音合成器

    1,836+0近 7 天星标变化
  • ParallelWaveGAN@kan-bayashi

    使用 PyTorch 的非官方 Parallel WaveGAN(含 MelGAN、Multi-band MelGAN、HiFi-GAN 与 StyleMelGAN)

    1,646+0近 7 天星标变化
  • dsnote@mkiol

    Speech Note Linux 应用程序。具备离线语音转文字、文字转语音以及机器翻译的笔记、阅读与翻译功能。

    1,622+0近 7 天星标变化
  • 扩展 ComfyUI 功能的自定义节点

    1,525+0近 7 天星标变化
  • SAM@s-macke

    软件自动语音合成器 - 微型语音合成器

    1,498+0近 7 天星标变化
  • SpeechT5@microsoft

    用于口语语言处理的统一模态语音文字预训练

    1,449+0近 7 天星标变化
  • 自架强大的 Chatterbox TTS 模型。此服务器提供用户友好的 Web UI、灵活的 API 端点(包含兼容 OpenAI)、预定义语音、语音克隆,以及大型有声书规模的文本处理。可在 NVIDIA (CUDA)、AMD (ROCm) 和 CPU 上加速运行。

    1,427+0近 7 天星标变化
  • 💎 适用于 ASR、TTS 及其他语音技术的无障碍语音语料库列表

    1,399+0近 7 天星标变化
  • voicefixer@haoheliu

    通用语音还原

    1,375+0近 7 天星标变化
  • World@mmorise

    高质量的语音分析、处理与合成系统

    1,339+0近 7 天星标变化
  • StreamSpeech@ictnlp

    StreamSpeech 是一个用于离线与同步语音识别、语音翻译及语音合成的“一体化”无缝模型。

    1,288+0近 7 天星标变化
  • Irodori-TTS@Aratako

    基于 Flow Matching 且支持 Emoji 驱动风格控制的文本转语音模型

    1,228+0近 7 天星标变化
  • BigVGAN@NVIDIA

    BigVGAN 官方 PyTorch 实现 (ICLR 2023)

    1,227+0近 7 天星标变化
  • Irina - 离线运行的俄语语音助手。通过插件支持技能。

    1,157+0近 7 天星标变化
  • AI-Waifu-Vtuber@ardha27

    用于在 Youtube/Twitch 上进行串流直播的 AI Vtuber

    1,116+3近 7 天星标变化
  • autovc@auspicious3000

    AutoVC:仅使用自动编码器损失的 Zero-Shot 语音风格转换

    1,101+0近 7 天星标变化
  • YourTTS@Edresson

    YourTTS:实现全民皆可用的零样本多发音人 TTS 与零样本语音转换

    1,054+1近 7 天星标变化
  • Cognitive-Speech-TTS@Azure-Samples

    微软语音合成 (Text-to-Speech) API 多语言示例代码,属于 Cognitive Services 的一部分。

    1,014+1近 7 天星标变化
  • alexandria-audiobook@Finrandojin

    AI 驱动的多语音有声书生成器 — LLM 脚本注解、语音复制、语音设计、LoRA 训练、逐行风格控制,以及导出为 MP3、分章 M4B 或 Audacity 多轨。基于 Qwen3-TTS 构建。

    1,003+10近 7 天星标变化
  • NISQA@gabrielmittag

    NISQA - 非侵入式语音质量与 TTS 自然度评估

    974+4近 7 天星标变化
  • 让任何兼容 SAPI 5 的应用程序都能使用 Azure 自然 TTS 语音。

    936+7近 7 天星标变化
  • FireRedTTS@FireRedTeam

    一个由 LLM 驱动的开源基础 TTS 系统

    919-1近 7 天星标变化
  • 一个无需互联网即可在你自己的计算机上运行的会说话的 LLM。

    891+1近 7 天星标变化
  • diffwave@lmnt-com

    DiffWave 是一个快速、高质量的神经声码器与波形合成器。

    884-1近 7 天星标变化
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS:多语言与跨语言 Zero-Shot TTS 引擎

    793+6近 7 天星标变化
  • vui@fluxions-ai

    实时语音助手 —— WebRTC 流式传输、faster-whisper ASR、本地 LLM、Vui Nano (300M) TTS。兼容 OpenAI Realtime API。支持语音克隆、插话打断,在 4090 上约有 9 倍实时性能。采用 Apache 2.0 许可证。

    760+7近 7 天星标变化
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice:一个免费、离线运行、高质量的德语 TTS 语音,适用于任何项目,免受版权困扰。

    729+0近 7 天星标变化
  • INTERSPEECH 2023-2024 论文集:收录 INTERSPEECH 2023-24 会议中具有影响力与精彩的研究论文。探索语音与语言处理的最新进展。内含代码。为此存储库点 Star 以支持语音技术的发展!

    684+0近 7 天星标变化
← 返回主题列表