跳到主要內容
buildradar
登入
主題 · speech-synthesis

speech-synthesis

標記 speech-synthesis 主題、收錄中的開源專案,依星數排序。

專案數
66
總星數
348,104
平均星數
5,274
佔比
0.02%

常跟 speech-synthesis 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 speech-synthesis 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • TTS@coqui-ai

    🐸💬 - 用於文字轉語音的深度學習工具包,已在研究與生產環境中驗證

    45,985+0近 7 天星數變化
  • VoxCPM@OpenBMB

    VoxCPM2:無需分詞器的多語言語音合成、創意語音設計與真實感克隆

    36,595+0近 7 天星數變化
  • Speech@NVIDIA-NeMo

    為研究人員與開發者打造的可擴展生成式 AI 框架,支援大型語言模型、多模態與語音 AI(自動語音辨識與文字轉語音)

    18,379+0近 7 天星數變化
  • leon@leon-ai

    🧠 Leon 是你的開源個人助理

    17,476+0近 7 天星數變化
  • DeepLearningExamples@NVIDIA

    最先進的深度學習腳本,依模型分類,易於訓練與部署,於企業級基礎設施上提供可重現的準確度與效能。

    14,846+0近 7 天星數變化
  • supertonic@supertone-inc

    閃電般快速、在裝置上執行的多語言 TTS —— 透過 ONNX 原生運行

    13,757+0近 7 天星數變化
  • speech-to-speech@huggingface

    使用開源模型構建語音代理

    13,015+0近 7 天星數變化
  • voice-pro@abus-aikorea

    Gradio WebUI 為創作者與開發者提供關鍵 TTS(Edge‑TTS、kokoro)與零樣本語音克隆(E2 & F5‑TTS、CosyVoice),並支援 Whisper 音訊處理、YouTube 下載、Demucs 人聲分離與多語言翻譯

    12,730+0近 7 天星數變化
  • PaddleSpeech@PaddlePaddle

    易用的語音工具包,包含自監督學習模型、SOTA/串流 ASR(含標點)、串流 TTS(含文字前端)、說話者驗證系統、端到端語音翻譯與關鍵詞偵測。榮獲 NAACL2022 最佳示範獎

    12,676+0近 7 天星數變化
  • edge-tts@rany2

    在 Python 中使用 Microsoft Edge 的線上文字轉語音服務,無需 Microsoft Edge、Windows 或 API 金鑰

    11,847+0近 7 天星數變化
  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)是一套音訊、音樂與語音生成工具箱,旨在支援可重現的研究,協助初學者與工程師快速進入音訊、音樂與語音生成的研發領域。

    10,276+0近 7 天星數變化
  • espnet@espnet

    端到端語音處理工具包

    9,949+0近 7 天星數變化
  • so-vits-svc-fork@voicepaw

    so-vits-svc 分支,支援即時功能、改進介面與更多特性

    9,329+0近 7 天星數變化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多聲音與提示控制的文字轉語音引擎

    8,522+0近 7 天星數變化
  • mlx-audio@Blaizzy

    一個基於 Apple MLX 框架的文字轉語音(TTS)、語音轉文字(STT)與語音轉語音(STS)函式庫,提供在 Apple Silicon 上高效的語音分析。

    7,826+0近 7 天星數變化
  • espeak-ng@espeak-ng

    eSpeak NG 是支援超過百種語言與口音的開源語音合成器

    6,802+0近 7 天星數變化
  • StyleTTS2@yl4579

    StyleTTS 2:透過風格擴散與對抗式訓練,結合大型語音語言模型,朝向人類水平的文字轉語音

    6,342+0近 7 天星數變化
  • silero-models@snakers4

    Silero 模型:讓預訓練文字轉語音模型變得極度簡單

    6,084+0近 7 天星數變化
  • abogen@denizsafak

    從 EPUB、PDF 與文字產生有同步字幕的有聲書。

    5,831+0近 7 天星數變化
  • DiffSinger@MoonInTheRiver

    DiffSinger:通過淺層擴散機制的歌聲合成(SVS & TTS);AAAI 2022;官方代碼

    4,855+0近 7 天星數變化
  • WhisperSpeech@WhisperSpeech

    一個開源的文字轉語音系統,透過反向 Whisper 建構

    4,645+0近 7 天星數變化
  • OpenUtau@openutau

    开放式歌唱合成平台 / 开源 UTAU 继任者

    4,258+0近 7 天星數變化
  • metavoice-src@metavoiceio

    面向人類般表達式TTS的基礎模型

    4,203+0近 7 天星數變化
  • RealtimeTTS@KoljaB

    Converts text to speech in realtime

    4,021+0近 7 天星數變化
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS:Tensorflow 2 的實時最先進語音合成(支援英語、法語、韓語、中文、德語,易於擴展至其他語言)

    3,996+0近 7 天星數變化
  • lingvo@tensorflow

    Lingvo

    2,864+0近 7 天星數變化
  • MARS5-TTS@Camb-ai

    來自 CAMB.AI 的 MARS5 語音模型 (TTS)

    2,818+0近 7 天星數變化
  • marytts@marytts

    MARY TTS -- 一個以純 Java 編寫的開源多語言文字轉語音合成系統

    2,583+0近 7 天星數變化
  • VieNeu-TTS@pnnbao97

    具備即時語音複製功能的越南語 TTS • 裝置端 • 即時 CPU 推論 • 24kHz 音訊品質 • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2,468+0近 7 天星數變化
  • hifi-gan@jik876

    HiFi-GAN:用於高效且高傳真語音合成的生成對抗網路

    2,367+0近 7 天星數變化
← 返回主題列表