Zum Hauptinhalt springen
buildradar
Sign in
Thema · text-to-audio

text-to-audio

Erfasste Open-Source-Repos mit dem Tag text-to-audio, sortiert nach Sternen.

Repos
13
Sterne gesamt
27.818
Sterne im Schnitt
2.140
Anteil
0,00%

Themen, die häufig gemeinsam mit text-to-audio am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit text-to-audio getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) ist ein Toolkit zur Audio-, Musik- und Sprachgenerierung. Sein Zweck ist es, reproduzierbare Forschung zu unterstützen und jüngeren Forschern sowie Ingenieuren den Einstieg in die Forschung und Entwicklung zur Audio-, Musik- und Sprachgenerierung zu erleichtern.

    10.276+1Sterne-Änderung der letzten 7 Tage
  • abogen@denizsafak

    Erstelle Hörbücher aus EPUBs, PDFs und Text mit synchronisierten Untertiteln.

    5.831+45Sterne-Änderung der letzten 7 Tage
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio: Zähmung des multimodalen gemeinsamen Trainings für die hochwertige Video-zu-Audio-Synthese

    2.264+0Sterne-Änderung der letzten 7 Tage
  • ThinkSound@QwenAudio

    [NeurIPS 2025] PyTorch-Implementierung von [ThinkSound], einem einheitlichen Framework zur Audiogenerierung aus beliebigen Modalitäten, gesteuert durch Chain-of-Thought (CoT)-Reasoning.

    1.378+0Sterne-Änderung der letzten 7 Tage
  • StreamSpeech@ictnlp

    StreamSpeech ist ein All-in-One-Modell für nahtlose Offline- und Simultanspracherkennung, -sprachübersetzung und -sprachsynthese.

    1.288+0Sterne-Änderung der letzten 7 Tage
  • audio-webui@gitmylo

    Ein Web-UI für verschiedene audiorelevante neuronale Netze

    1.246+0Sterne-Änderung der letzten 7 Tage
  • tango@declare-lab

    Eine Familie von Diffusionsmodellen zur Generierung von Text zu Audio.

    1.238-1Sterne-Änderung der letzten 7 Tage
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley: Multimodale Diffusion mit Repräsentationsausrichtung zur treuen Foley-Audioerzeugung.

    1.056+4Sterne-Änderung der letzten 7 Tage
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux: Super schnelle und treue Text-zu-Audio-Generierung mit Flow Matching

    882+0Sterne-Änderung der letzten 7 Tage
  • Make-An-Audio@Text-to-Audio

    PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-to-Audio Generative Model

    668+0Sterne-Änderung der letzten 7 Tage
  • OpenMusic@ivcylc

    OpenMusic: SOTA Text-to-Music (TTM) Generierung

    631+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).

    552+0Sterne-Änderung der letzten 7 Tage
  • unified-audio@alibaba

    Ein Open-Source-Projekt zur Vereinheitlichung von Audioverarbeitung und -generierung

    512+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen