跳到主要內容
buildradar
登入
主題 · text-to-speech

text-to-speech

標記 text-to-speech 主題、收錄中的開源專案,依星數排序。

專案數
150
總星數
955,097
平均星數
6,367
佔比
0.05%

常跟 text-to-speech 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 text-to-speech 主題的專案。

  • qwen-audio-agent@QwenAudio

    即時語音執行階段,讓 Agent 保持對話、運作與在線狀態。AI Agent 的即時語音執行階段。

    2,379
  • audio.cpp@0xShug0

    一款由 ggml 驅動的一體化純 C++ 音訊模型推理引擎。支援 TTS、STT、VAD、語音轉換、音樂生成等功能,具備高度優化的效能,無需依賴 Python。

    2,214
  • ai-video-editor@MartinDelophy

    開源、優先本地端的影片編輯器,創作者與 AI 代理可編輯同一個真實時間軸

    798
  • 無需 ROOT 的開源 Android 螢幕即時翻譯工具,適合遊戲、視覺小說和漫畫。支援端側與雲端 OCR、離線 LLM、多種翻譯服務和文字朗讀(TTS),譯文可直接顯示在畫面上。

    794
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    544
  • MoneyPrinterTurbo@harry0703

    利用 AI 大模型與自動化工作流程,依主題或關鍵字一鍵產生高清短影片。

    119,977+0近 7 天星數變化
  • unsloth@unslothai

    本機 UI,用於執行與訓練 LLM 與擴散模型,支援 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等多種模型

    75,515+0近 7 天星數變化
  • GPT-SoVITS@RVC-Boss

    1 分鐘的語音資料也能用來訓練高品質的 TTS 模型!(少量樣本語音克隆)

    61,476+0近 7 天星數變化
  • OpenMontage@calesthio

    世界首个开源代理式视频制作系统。12条生产流水线,100+ 工具,700+ 代理技能与生产知识文件。将你的 AI 编码助手变成完整的视频制作工作室

    55,719+0近 7 天星數變化
  • TTS@coqui-ai

    🐸💬 - 用於文字轉語音的深度學習工具包,已在研究與生產環境中驗證

    45,985+0近 7 天星數變化
  • ChatTTS@2noise

    用於日常對話的生成式語音模型。

    39,814+0近 7 天星數變化
  • OpenVoice@myshell-ai

    MIT 與 MyShell 合作的即時語音克隆,音頻基礎模型

    37,419+0近 7 天星數變化
  • MockingBird@babysor

    🚀在 5 秒內克隆聲音,實時產生任意語音

    36,912+0近 7 天星數變化
  • VoxCPM@OpenBMB

    VoxCPM2:無需分詞器的多語言語音合成、創意語音設計與真實感克隆

    36,595+0近 7 天星數變化
  • index-tts@index-tts

    工業級可控且高效的零樣本文字轉語音系統

    23,686+0近 7 天星數變化
  • CosyVoice@QwenAudio

    多語言大型語音生成模型,提供推論、訓練與部署全端能力

    23,426+0近 7 天星數變化
  • dia@nari-labs

    一個能一次性生成超寫實對話的 TTS 模型

    19,387+0近 7 天星數變化
  • pyvideotrans@jianchang512

    將影片從一種語言翻譯成另一種語言,並嵌入配音與字幕。

    18,871+0近 7 天星數變化
  • leon@leon-ai

    🧠 Leon 是你的開源個人助理

    17,476+0近 7 天星數變化
  • VoiceStudio@debpalash

    VoiceStudio 是開源、完全本地化的 ElevenLabs 替代方案——支援 646 種語言的語音克隆、語音設計、影片配音、口述、轉錄與有聲書製作。

    14,835+0近 7 天星數變化
  • sherpa-onnx@k2-fsa

    使用次世代 Kaldi 與 onnxruntime 的語音轉文字、文字轉語音、說話者分離、語音增強、聲源分離與 VAD,支援離線運行。支援嵌入式系統、Android、iOS、HarmonyOS、Raspberry Pi、RISC‑V、RK NPU、Axera NPU、Ascend NPU、x86_64 伺服器、WebSocket 伺服器/客戶端,支援 12 種程式語言

    14,575+0近 7 天星數變化
  • supertonic@supertone-inc

    閃電般快速、在裝置上執行的多語言 TTS —— 透過 ONNX 原生運行

    13,757+0近 7 天星數變化
  • voice-pro@abus-aikorea

    Gradio WebUI 為創作者與開發者提供關鍵 TTS(Edge‑TTS、kokoro)與零樣本語音克隆(E2 & F5‑TTS、CosyVoice),並支援 Whisper 音訊處理、YouTube 下載、Demucs 人聲分離與多語言翻譯

    12,730+0近 7 天星數變化
  • edge-tts@rany2

    在 Python 中使用 Microsoft Edge 的線上文字轉語音服務,無需 Microsoft Edge、Windows 或 API 金鑰

    11,847+0近 7 天星數變化
  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)是一套音訊、音樂與語音生成工具箱,旨在支援可重現的研究,協助初學者與工程師快速進入音訊、音樂與語音生成的研發領域。

    10,276+0近 7 天星數變化
  • espnet@espnet

    端到端語音處理工具包

    9,949+0近 7 天星數變化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多聲音與提示控制的文字轉語音引擎

    8,522+0近 7 天星數變化
  • mlx-audio@Blaizzy

    一個基於 Apple MLX 框架的文字轉語音(TTS)、語音轉文字(STT)與語音轉語音(STS)函式庫,提供在 Apple Silicon 上高效的語音分析。

    7,826+0近 7 天星數變化
  • MeloTTS@myshell-ai

    MyShell.ai 提供的高品質多語言文字轉語音庫,支援英語、西班牙語、法語、中文、日語與韓語

    7,616+0近 7 天星數變化
  • espeak-ng@espeak-ng

    eSpeak NG 是支援超過百種語言與口音的開源語音合成器

    6,802+0近 7 天星數變化
  • argmax-oss-swift@argmaxinc

    Apple Silicon 上的本機語音 AI

    6,353+0近 7 天星數變化
  • StyleTTS2@yl4579

    StyleTTS 2:透過風格擴散與對抗式訓練,結合大型語音語言模型,朝向人類水平的文字轉語音

    6,342+0近 7 天星數變化
  • Awesome-Prompt-Engineering@promptslab

    本仓库包含手工挑选的 Prompt Engineering 资源,重点关注 Generative Pre-trained Transformer (GPT)、ChatGPT、PaLM 等

    6,306+0近 7 天星數變化
  • silero-models@snakers4

    Silero 模型:讓預訓練文字轉語音模型變得極度簡單

    6,084+0近 7 天星數變化
  • ODS@Osmantic

    將你的 PC、Mac 或 Linux 盒子變成 AI 伺服器。LLM 推理、聊天 UI、語音、代理、工作流程、RAG 與圖像生成

    5,931+0近 7 天星數變化
← 返回主題列表