跳到主要内容
buildradar
登录
主题 · text-to-audio

text-to-audio

标记 text-to-audio 主题、收录中的开源项目,按星标数排序。

项目数
13
总星标数
27,818
平均星标数
2,140
占比
0.00%

常跟 text-to-audio 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 text-to-audio 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)是一个音频、音乐和语音生成工具箱,旨在支持可重复研究,帮助初学者和工程师快速进入音频、音乐和语音生成的研发领域。

    10,276+0近 7 天星标变化
  • abogen@denizsafak

    从 EPUB、PDF 和文本生成带同步字幕的有声书。

    5,831+0近 7 天星标变化
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio:驯服多模态联合训练以实现高质量视频转音频合成

    2,264+0近 7 天星标变化
  • ThinkSound@QwenAudio

    [NeurIPS 2025] [ThinkSound] 的 PyTorch 实现,这是一个由思维链(CoT)推理引导、从任何模态生成音频的统一框架。

    1,378+0近 7 天星标变化
  • StreamSpeech@ictnlp

    StreamSpeech 是一个用于离线与同步语音识别、语音翻译及语音合成的“一体化”无缝模型。

    1,288+0近 7 天星标变化
  • audio-webui@gitmylo

    一个用于各种音频相关神经网络的 WebUI

    1,246+0近 7 天星标变化
  • tango@declare-lab

    用于文本转语音生成的扩散模型系列。

    1,238+0近 7 天星标变化
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley:结合表示对齐与多模态扩散的高保真 Foley 音频生成模型

    1,057+3近 7 天星标变化
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux:基于流匹配(Flow Matching)的超快速、高保真度文本转音频生成

    882+0近 7 天星标变化
  • Make-An-Audio@Text-to-Audio

    Make-An-Audio (ICML'23) 文本转音频生成模型的 PyTorch 实现

    668+0近 7 天星标变化
  • OpenMusic@ivcylc

    OpenMusic:SOTA 文本转音乐(TTM)生成

    633+1近 7 天星标变化
  • 精选基于 LLM 的多模态生成(图像、视频、3D 与音频)论文列表。

    552+0近 7 天星标变化
  • unified-audio@alibaba

    一个统一音频处理与生成的开源项目。

    520+10近 7 天星标变化
← 返回主题列表