Lompat ke konten utama
buildradar
Sign in
Topik · text-to-audio

text-to-audio

Repositori open source terpantau bertanda text-to-audio, diurutkan berdasarkan bintang.

Repositori
13
Total bintang
27.818
Rata-rata bintang
2.140
Porsi
0,00%

Topik yang sering muncul berdampingan dengan text-to-audio di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda text-to-audio.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) adalah toolkit untuk Pembuatan Audio, Musik, dan Ucapan. Tujuannya adalah untuk mendukung penelitian yang dapat direproduksi dan membantu para peneliti serta insinyur junior untuk memulai di bidang penelitian dan pengembangan pembuatan audio, musik, dan ucapan.

    10.276+1Perubahan bintang dalam 7 hari terakhir
  • abogen@denizsafak

    Menghasilkan buku audio dari EPUB, PDF, dan teks dengan teks terjemahan (caption) yang disinkronkan.

    5.831+45Perubahan bintang dalam 7 hari terakhir
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio: Menjinakkan Pelatihan Bersama Multimodal untuk Sintesis Video-ke-Audio Berkualitas Tinggi

    2.264+0Perubahan bintang dalam 7 hari terakhir
  • ThinkSound@QwenAudio

    [NeurIPS 2025] Implementasi PyTorch dari [ThinkSound], kerangka kerja terpadu untuk menghasilkan audio dari modalitas apa pun, dipandu oleh penalaran Chain-of-Thought (CoT).

    1.378+0Perubahan bintang dalam 7 hari terakhir
  • StreamSpeech@ictnlp

    StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.

    1.288+0Perubahan bintang dalam 7 hari terakhir
  • audio-webui@gitmylo

    Antarmuka web (webui) untuk berbagai Jaringan Saraf Tiruan terkait audio

    1.246+0Perubahan bintang dalam 7 hari terakhir
  • tango@declare-lab

    Sekeluarga model difusi untuk generasi teks-ke-audio.

    1.238-1Perubahan bintang dalam 7 hari terakhir
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley: Difusi Multimodal dengan Penyelarasan Representasi untuk Pembuatan Audio Foley Berkualitas Tinggi.

    1.058+4Perubahan bintang dalam 7 hari terakhir
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux: Pembuatan Teks ke Audio yang Sangat Cepat dan Akurat dengan Flow Matching

    882+0Perubahan bintang dalam 7 hari terakhir
  • Make-An-Audio@Text-to-Audio

    Implementasi PyTorch untuk Make-An-Audio (ICML'23) dengan Model Generatif Text-to-Audio

    668+0Perubahan bintang dalam 7 hari terakhir
  • OpenMusic@ivcylc

    OpenMusic: Generasi Text-to-music (TTM) SOTA

    632+1Perubahan bintang dalam 7 hari terakhir
  • 🔥🔥🔥 Daftar kurasi makalah tentang generasi multimodal berbasis LLM (gambar, video, 3D, dan audio).

    552+0Perubahan bintang dalam 7 hari terakhir
  • unified-audio@alibaba

    Proyek Sumber Terbuka untuk Menyatukan Pemrosesan dan Pembuatan Audio

    513+3Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik