跳到主要内容
buildradar
Sign in
主题 · tts

tts

标记 tts 主题、收录中的开源项目,按星标数排序。

项目数
190
总星标数
1,061,717
平均星标数
5,588
占比
0.06%

常跟 tts 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 tts 主题的项目。

  • audio.cpp@0xShug0

    一款由 ggml 驱动的一体化纯 C++ 音频模型推理引擎。支持 TTS、STT、VAD、语音转换、音乐生成等功能,具备高度优化的性能,无 Python 依赖。

    2,214
  • vox-director@Alisa0808

    将单一主题转化为制作完成的 Vox 风格纸艺拼贴解说/广告视频 — 在 Atlas Cloud + ffmpeg 上实现端到端自动化。一项 agent 技能。

    1,698
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    830
  • 无需 ROOT 的开源 Android 屏幕实时翻译工具,适合游戏、视觉小说和漫画。支持端侧与云端 OCR、离线 LLM、多种翻译服务和文字朗读(TTS),译文可直接显示在画面上。

    794
  • cs-board@ChenShuo2004

    将参考声音和中文文案自动生成白板动画视频的本地 AI 工具。

    540
  • unsloth@unslothai

    本机 UI,用于运行与训练 LLM 与扩散模型,支持 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等多种模型

    75,515+337近 7 天星标变化
  • GPT-SoVITS@RVC-Boss

    1 分钟的语音数据也能用来训练高质量的 TTS 模型!(少量样本语音克隆)

    61,476+138近 7 天星标变化
  • 在 5 秒内克隆声音,实时生成任意语音

    60,117-4近 7 天星标变化
  • LocalAI@mudler

    LocalAI 为开源 AI 引擎,可在任何硬件上运行任意模型(LLM、视觉、语音、图像、视频),无需 GPU

    48,833+84近 7 天星标变化
  • TTS@coqui-ai

    🐸💬 - 用于文字转语音的深度学习工具包,已在研究与生产环境中验证

    45,985+18近 7 天星标变化
  • ChatTTS@2noise

    用于日常对话的生成式语音模型。

    39,814+9近 7 天星标变化
  • OpenVoice@myshell-ai

    MIT 与 MyShell 的即时语音克隆,音频基础模型

    37,419+61近 7 天星标变化
  • MockingBird@babysor

    🚀在 5 秒内克隆声音,实时生成任意语音

    36,912+0近 7 天星标变化
  • VoxCPM@OpenBMB

    VoxCPM2:无需分词器的多语言语音生成、创意语音设计与真实感克隆

    36,595+345近 7 天星标变化
  • fish-speech@fishaudio

    SOTA 开源文字转语音

    32,510+52近 7 天星标变化
  • Pixelle-Video@ATH-MaaS

    🚀 AI 全自动短视频引擎

    27,702+236近 7 天星标变化
  • mastra@mastra-ai

    Mastra 是用于 AI 驱动应用与代理的现代 TypeScript 框架

    27,657+96近 7 天星标变化
  • readest@readest

    Readest 是一款现代且功能丰富的电子书阅读器,为热衷阅读者提供无缝跨平台访问、强大工具与直觉界面,提升阅读体验

    24,008+138近 7 天星标变化
  • index-tts@index-tts

    工业级可控且高效的零样本文字转语音系统

    23,686+109近 7 天星标变化
  • CosyVoice@QwenAudio

    多语言大型语音生成模型,提供推理、训练与部署全栈能力

    23,426+359近 7 天星标变化
  • ebook2audiobook@DrewThomasson

    从电子书生成有声书,支持语音克隆和 1158+ 种语言!

    20,097+34近 7 天星标变化
  • pot-desktop@pot-app

    🌈 一个跨平台的划词翻译和 OCR 软件

    19,408+28近 7 天星标变化
  • Speech@NVIDIA-NeMo

    为研究人员与开发者打造的可扩展生成式 AI 框架,支持大型语言模型、多模态与语音 AI(自动语音识别与文本转语音)

    18,379+21近 7 天星标变化
  • VoiceStudio@debpalash

    VoiceStudio 是开源、完全本地化的 ElevenLabs 替代方案——支持 646 种语言的语音克隆、语音设计、视频配音、口述、转录与有声书制作。

    14,835+2,880近 7 天星标变化
  • supertonic@supertone-inc

    闪电般快速、在设备上运行的多语言 TTS —— 通过 ONNX 原生运行

    13,757+20近 7 天星标变化
  • voice-pro@abus-aikorea

    Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译

    12,730+54近 7 天星标变化
  • PaddleSpeech@PaddlePaddle

    易用的语音工具包,包含自监督学习模型、SOTA/流式 ASR(含标点)、流式 TTS(含文字前端)、说话者验证系统、端到端语音翻译与关键词检测。荣获 NAACL2022 最佳示范奖

    12,676+5近 7 天星标变化
  • edge-tts@rany2

    在 Python 中使用 Microsoft Edge 的在线文字转语音服务,无需 Microsoft Edge、Windows 或 API 密钥

    11,847+29近 7 天星标变化
  • KrillinAI@krillinai

    AI 视频翻译与配音工具,面向人类与 AI Agent,100+ 语言全链路,CLI 分阶段调用,适配抖音、小红书、哔哩哔哩、视频号、TikTok、YouTube。

    11,333+46近 7 天星标变化
  • moonshine@moonshine-ai

    Very low latency speech to text, intent recognition, and text to speech, for building voice agents and interfaces

    10,997+33近 7 天星标变化
  • voltagent@VoltAgent

    基于开源 TypeScript AI Agent 框架的 AI 代理工程平台

    10,529+80近 7 天星标变化
  • Bert-VITS2@fishaudio

    vits2 骨干结合 multilingual-bert

    8,794-3近 7 天星标变化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多语音与提示控制的文字转语音引擎

    8,522-1近 7 天星标变化
  • audiblez@santinic

    从电子书生成有声书

    8,479+9近 7 天星标变化
  • Vision-Agents@GetStream

    Stream 的 Open Vision Agents。使用任意模型或视频提供者快速构建语音与视觉代理,利用 Stream 边缘网络实现超低延迟

    8,113+9近 7 天星标变化
← 返回主题列表