跳到主要內容
buildradar
登入
主題 · text-to-audio

text-to-audio

標記 text-to-audio 主題、收錄中的開源專案,依星數排序。

專案數
13
總星數
27,818
平均星數
2,140
佔比
0.00%

常跟 text-to-audio 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 text-to-audio 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)是一套音訊、音樂與語音生成工具箱,旨在支援可重現的研究,協助初學者與工程師快速進入音訊、音樂與語音生成的研發領域。

    10,276+0近 7 天星數變化
  • abogen@denizsafak

    從 EPUB、PDF 與文字產生有同步字幕的有聲書。

    5,831+0近 7 天星數變化
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio:掌控多模態聯合訓練以實現高品質視訊轉音訊合成

    2,264+0近 7 天星數變化
  • ThinkSound@QwenAudio

    [NeurIPS 2025] [ThinkSound] 的 PyTorch 實作,這是一個由思維鏈(CoT)推理引導、從任何模態生成音訊的統一框架。

    1,378+0近 7 天星數變化
  • StreamSpeech@ictnlp

    StreamSpeech 是一個用於離線與同步語音辨識、語音翻譯及語音合成的「一體化」無縫模型。

    1,288+0近 7 天星數變化
  • audio-webui@gitmylo

    一個用於各種音訊相關神經網路的 WebUI

    1,246+0近 7 天星數變化
  • tango@declare-lab

    用於文字轉語音生成的擴散模型系列。

    1,238+0近 7 天星數變化
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley:結合表示對齊與多模態擴散的高傳真 Foley 音訊生成模型

    1,057+3近 7 天星數變化
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux:基於流匹配(Flow Matching)的超快速、高逼真度文字轉語音生成

    882+0近 7 天星數變化
  • Make-An-Audio@Text-to-Audio

    Make-An-Audio (ICML'23) 文字轉語音生成模型的 PyTorch 實作

    668+0近 7 天星數變化
  • OpenMusic@ivcylc

    OpenMusic:SOTA 文字轉音樂(TTM)生成

    632+1近 7 天星數變化
  • 精選基於 LLM 的多模態生成(影像、影片、3D 與音訊)論文列表。

    552+0近 7 天星數變化
  • unified-audio@alibaba

    一個統一音訊處理與生成的開源專案。

    520+4近 7 天星數變化
← 返回主題列表