跳到主要内容
buildradar
登录
主题 · text-to-speech

text-to-speech

标记 text-to-speech 主题、收录中的开源项目,按星标数排序。

共 151 个项目
  • flutter_tts@dlutton

    Flutter 语音合成套件

    753+0近 7 天星标变化
  • kokoro-web@eduardolat

    🔊 Kokoro Web:免费的 AI 文字转语音,支持在线或自建,兼容 OpenAI!

    733+1近 7 天星标变化
  • voice-ai@rapidaai

    Rapida 是一个开源的端到端语音 AI 编排平台,用于构建具备音频流、STT、TTS、VAD、多通道集成、代理状态管理与可观测性的实时对话语音代理。

    726+5近 7 天星标变化
  • curses@mmpneo

    适用于 OBS、VRChat、Twitch 聊天室与 Discord 的语音转文字和 KB 输入字幕

    720+0近 7 天星标变化
  • voicebox-pytorch@lucidrains

    使用 PyTorch 实现 MetaAI 的全新 SOTA Text-to-speech 网络 Voicebox

    704+0近 7 天星标变化
  • podcast-maker@FelippeChemello

    使用动态图形与文字转语音合成技术的全自动视频制作工具,可将电子报转为每日 YouTube 视频。

    703+0近 7 天星标变化
  • 使用 OpenAI Whisper 与 TensorFlow Lite 在 Android 上进行离线语音识别

    689+1近 7 天星标变化
  • chatterbox-tts-api@travisvn

    使用 Chatterbox 的本地、兼容 OpenAI 的文本转语音 (TTS) API,让用户能在任何使用 OpenAI API 的地方生成语音克隆内容(例如 Open WebUI、AnythingLLM 等)

    678+1近 7 天星标变化
  • dictionariez@pnlpal

    📚 一款可自定义的字典扩展功能,支持超过 20 种语言、1000 多本字典的双击查询、文字转语音、翻译以及 Anki 集成。

    671+0近 7 天星标变化
  • LLaSA_training@zhenye234

    LLaSA: 扩展基于 LLaMA 的语音合成之训练期与推理期算力

    658+2近 7 天星标变化
  • f5-tts-mlx@lucasnewman

    在 MLX 中实现 F5-TTS

    644+0近 7 天星标变化
  • examples@elevenlabs
    626+1近 7 天星标变化
  • Pandrator@lukaszliniewicz

    将 PDF 与 EPUB 转为有声书;将字幕或视频转为配音视频(包含翻译)等等。完全免费。Pandrator 使用本机模型,包含语音复制(即时、RVC 强化、XTTS 微调)与 LLM 处理。期许成为一个具备图形界面、安装程序与一体化套件的使用者友善应用程序。

    622+4近 7 天星标变化
  • tiktok-voice@oscie57

    与 TikTok TTS API 交互的简单 Python 脚本

    611+0近 7 天星标变化
  • ComfyUI-VibeVoice@wildminder

    用于 VibeVoice TTS 的 ComfyUI 自定义节点。具备表现力、长文本、多说话人对话语音功能

    596-1近 7 天星标变化
  • 您的应用程序自动编码系统 — 用于 React Native 的 Alan AI SDK

    575+0近 7 天星标变化
  • Chatterbox 的修改版本,支持文本文件输入且无字符限制。我用它来制作有声书,特别是给孩子们听的。

    575-1近 7 天星标变化
  • 在 Mac (M1/M2/M3/M4) 上本地运行 Qwen3-TTS 文字转语音。支持语音克隆、语音设计与自定义语音,使用 MLX 实现 100% 离线运行

    561+0近 7 天星标变化
  • 精选基于 LLM 的多模态生成(图像、视频、3D 与音频)论文列表。

    552+0近 7 天星标变化
  • orpheus-tts-local@isaiahbjork

    使用 LM Studio 在本地运行 Orpheus 3B。

    550+0近 7 天星标变化
  • vits2_pytorch@p0p4k

    非官方的 vits2-TTS PyTorch 实现。

    549+0近 7 天星标变化
  • payload-ai@ashbuilds

    AI Plugin 是 Payload CMS 的强大扩展功能,整合先进 AI 能力以增强内容创建与管理。

    548+1近 7 天星标变化
  • ComfyUI-OmniVoice-TTS@Saganaki22

    ComfyUI 的 OmniVoice TTS 节点 - 支持语音克隆、语音设计与多说话人对话的零样本多语言文字转语音技术

    548+6近 7 天星标变化
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    547+14近 7 天星标变化
  • EDDI@EDCD

    Elite Dangerous 的辅助应用程序

    525+2近 7 天星标变化
  • e2-tts-pytorch@lucidrains

    E2-TTS 实现,“极致简单的完全非自回归零样本 TTS”,基于 Pytorch

    517+0近 7 天星标变化
  • vixtts-demo@thinhlpg

    越南语语音复制文字转语音模型 ✨

    516-1近 7 天星标变化
  • 开源、本地且可自托管的高性能语言推理服务器,支持通过 WebRTC、REST 与 WS 进行 ASR/STT、TTS 与 LLM 推理

    512+0近 7 天星标变化
  • ComfyUI-VoxCPM@wildminder

    用于高表现力语音与真实零样本语音复制的 ComfyUI 节点

    509-1近 7 天星标变化
  • AuK@Tencent-Hunyuan

    AuK: An Open-Source Foundational Model for Speech Generation and Editing

    504近 7 天星标变化
← 返回主题列表