跳到主要内容
buildradar
登录
主题 · text-to-speech

text-to-speech

标记 text-to-speech 主题、收录中的开源项目,按星标数排序。

项目数
150
总星标数
955,097
平均星标数
6,367
占比
0.05%

常跟 text-to-speech 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 text-to-speech 主题的项目。

  • qwen-audio-agent@QwenAudio

    实时语音运行时,让 Agent 保持对话、运作与在线状态。AI Agent 的实时语音运行时。

    2,402
  • audio.cpp@0xShug0

    一款由 ggml 驱动的一体化纯 C++ 音频模型推理引擎。支持 TTS、STT、VAD、语音转换、音乐生成等功能,具备高度优化的性能,无 Python 依赖。

    2,214
  • 无需 ROOT 的开源 Android 屏幕实时翻译工具,适合游戏、视觉小说和漫画。支持端侧与云端 OCR、离线 LLM、多种翻译服务和文字朗读(TTS),译文可直接显示在画面上。

    809
  • ai-video-editor@MartinDelophy

    开源、优先本地端的视频编辑器,创作者与 AI 代理可编辑同一个真实时间轴

    803
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    547
  • MoneyPrinterTurbo@harry0703

    利用 AI 大模型与自动化工作流,根据主题或关键词一键生成高清短视频。

    119,977+0近 7 天星标变化
  • unsloth@unslothai

    本机 UI,用于运行与训练 LLM 与扩散模型,支持 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等多种模型

    75,515+0近 7 天星标变化
  • GPT-SoVITS@RVC-Boss

    1 分钟的语音数据也能用来训练高质量的 TTS 模型!(少量样本语音克隆)

    61,476+0近 7 天星标变化
  • OpenMontage@calesthio

    世界首个开源代理式视频制作系统。12条生产流水线,100+ 工具,700+ 代理技能与生产知识文件。将你的 AI 编码助手变成完整的视频制作工作室

    55,719+0近 7 天星标变化
  • TTS@coqui-ai

    🐸💬 - 用于文字转语音的深度学习工具包,已在研究与生产环境中验证

    45,985+0近 7 天星标变化
  • ChatTTS@2noise

    用于日常对话的生成式语音模型。

    39,814+0近 7 天星标变化
  • OpenVoice@myshell-ai

    MIT 与 MyShell 的即时语音克隆,音频基础模型

    37,419+0近 7 天星标变化
  • MockingBird@babysor

    🚀在 5 秒内克隆声音,实时生成任意语音

    36,912+0近 7 天星标变化
  • VoxCPM@OpenBMB

    VoxCPM2:无需分词器的多语言语音生成、创意语音设计与真实感克隆

    36,595+0近 7 天星标变化
  • index-tts@index-tts

    工业级可控且高效的零样本文字转语音系统

    23,686+0近 7 天星标变化
  • CosyVoice@QwenAudio

    多语言大型语音生成模型,提供推理、训练与部署全栈能力

    23,426+0近 7 天星标变化
  • dia@nari-labs

    一个一次性生成超写实对话的 TTS 模型。

    19,387+0近 7 天星标变化
  • pyvideotrans@jianchang512

    将视频从一种语言翻译成另一种语言,并嵌入配音与字幕。

    18,871+0近 7 天星标变化
  • leon@leon-ai

    🧠 Leon 是你的开源个人助理

    17,476+0近 7 天星标变化
  • VoiceStudio@debpalash

    VoiceStudio 是开源、完全本地化的 ElevenLabs 替代方案——支持 646 种语言的语音克隆、语音设计、视频配音、口述、转录与有声书制作。

    14,835+0近 7 天星标变化
  • sherpa-onnx@k2-fsa

    使用次世代 Kaldi 与 onnxruntime 的语音转文字、文字转语音、说话者分离、语音增强、声源分离与 VAD,支持离线运行。支持嵌入式系统、Android、iOS、HarmonyOS、Raspberry Pi、RISC‑V、RK NPU、Axera NPU、Ascend NPU、x86_64 服务器、WebSocket 服务器/客户端,支持 12 种编程语言

    14,575+0近 7 天星标变化
  • supertonic@supertone-inc

    闪电般快速、在设备上运行的多语言 TTS —— 通过 ONNX 原生运行

    13,757+0近 7 天星标变化
  • voice-pro@abus-aikorea

    Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译

    12,730+0近 7 天星标变化
  • edge-tts@rany2

    在 Python 中使用 Microsoft Edge 的在线文字转语音服务,无需 Microsoft Edge、Windows 或 API 密钥

    11,847+0近 7 天星标变化
  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)是一个音频、音乐和语音生成工具箱,旨在支持可重复研究,帮助初学者和工程师快速进入音频、音乐和语音生成的研发领域。

    10,276+0近 7 天星标变化
  • espnet@espnet

    端到端语音处理工具包

    9,949+0近 7 天星标变化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多语音与提示控制的文字转语音引擎

    8,522+0近 7 天星标变化
  • mlx-audio@Blaizzy

    一个基于 Apple MLX 框架的文字转语音(TTS)、语音转文字(STT)与语音转语音(STS)库,提供在 Apple Silicon 上高效的语音分析。

    7,826+0近 7 天星标变化
  • MeloTTS@myshell-ai

    MyShell.ai 提供的高质量多语言文字转语音库,支持英语、西班牙语、法语、中文、日语和韩语

    7,616+0近 7 天星标变化
  • espeak-ng@espeak-ng

    eSpeak NG 是支持超过百种语言与口音的开源语音合成器

    6,802+0近 7 天星标变化
  • argmax-oss-swift@argmaxinc

    Apple Silicon 上的本机语音 AI

    6,353+0近 7 天星标变化
  • StyleTTS2@yl4579

    StyleTTS 2:通过风格扩散与对抗训练,结合大型语音语言模型,迈向人类水平的文本转语音

    6,342+0近 7 天星标变化
  • Awesome-Prompt-Engineering@promptslab

    本仓库包含手工挑选的 Prompt Engineering 资源,重点关注 Generative Pre-trained Transformer (GPT)、ChatGPT、PaLM 等

    6,306+0近 7 天星标变化
  • silero-models@snakers4

    Silero 模型:让预训练文字转语音模型变得极度简单

    6,084+0近 7 天星标变化
  • ODS@Osmantic

    将你的 PC、Mac 或 Linux 盒子变成 AI 服务器。LLM 推理、聊天 UI、语音、代理、工作流程、RAG 与图像生成

    5,931+0近 7 天星标变化
← 返回主题列表