メインコンテンツへスキップ
buildradar
Sign in
トピック · text-to-audio

text-to-audio

text-to-audio がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
13
総スター数
27,818
平均スター数
2,140
シェア
0.00%

text-to-audio と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、text-to-audio がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) は、オーディオ、音楽、音声生成のためのツールキットです。再現性のある研究をサポートし、若手研究者やエンジニアがオーディオ、音楽、音声生成の研究開発分野を始めやすくすることを目的としています。

    10,276+1直近 7 日のスター増減
  • abogen@denizsafak

    同期キャプション付きで、EPUB、PDF、およびテキストからオーディオブックを生成します。

    5,831+45直近 7 日のスター増減
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio: 高品質なビデオ・オーディオ合成に向けたマルチモーダル共同学習の制御

    2,264+0直近 7 日のスター増減
  • ThinkSound@QwenAudio

    [NeurIPS 2025] Chain-of-Thought (CoT) 推論に誘導され、あらゆるモダリティから音声を生成する統合フレームワーク [ThinkSound] の PyTorch 実装

    1,378+0直近 7 日のスター増減
  • StreamSpeech@ictnlp

    StreamSpeech は、オフラインおよび同時音声認識、音声翻訳、音声合成のための「オールインワン」シームレスモデルです。

    1,288+0直近 7 日のスター増減
  • audio-webui@gitmylo

    様々な音声関連のNeural Network向けWebUI

    1,246+0直近 7 日のスター増減
  • tango@declare-lab

    テキストからオーディオを生成する拡散モデルのファミリ。

    1,238-1直近 7 日のスター増減
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley: 高忠実度Foley音声生成のための表現アライメントを用いたマルチモーダル拡散。

    1,056+4直近 7 日のスター増減
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux: Flow Matching を用いた超高速かつ高忠実度な Text-to-Audio 生成

    882+0直近 7 日のスター増減
  • Make-An-Audio@Text-to-Audio

    テキスト音声生成モデルを使用したMake-An-Audio(ICML'23)のPyTorch実装

    668+0直近 7 日のスター増減
  • OpenMusic@ivcylc

    OpenMusic: SOTA Text-to-Music (TTM) 生成

    631+1直近 7 日のスター増減
  • 🔥🔥🔥 LLMベースのマルチモーダル生成(画像、動画、3D、音声)に関する厳選された論文リスト

    552+0直近 7 日のスター増減
  • unified-audio@alibaba

    音声処理と生成を統合するオープンソースプロジェクト

    512+1直近 7 日のスター増減
← トピック一覧に戻る