text-to-audio
Repositori open source terpantau bertanda text-to-audio, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan text-to-audio di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda text-to-audio.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Amphion (/æmˈfaɪən/) adalah toolkit untuk Pembuatan Audio, Musik, dan Ucapan. Tujuannya adalah untuk mendukung penelitian yang dapat direproduksi dan membantu para peneliti serta insinyur junior untuk memulai di bidang penelitian dan pengembangan pembuatan audio, musik, dan ucapan.
★ 10.276+1Perubahan bintang dalam 7 hari terakhir - #2
Menghasilkan buku audio dari EPUB, PDF, dan teks dengan teks terjemahan (caption) yang disinkronkan.
★ 5.831+45Perubahan bintang dalam 7 hari terakhir - #3
[CVPR 2025] MMAudio: Menjinakkan Pelatihan Bersama Multimodal untuk Sintesis Video-ke-Audio Berkualitas Tinggi
★ 2.264+0Perubahan bintang dalam 7 hari terakhir - #4
[NeurIPS 2025] Implementasi PyTorch dari [ThinkSound], kerangka kerja terpadu untuk menghasilkan audio dari modalitas apa pun, dipandu oleh penalaran Chain-of-Thought (CoT).
★ 1.378+0Perubahan bintang dalam 7 hari terakhir - #5
StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.
★ 1.288+0Perubahan bintang dalam 7 hari terakhir - #6
Antarmuka web (webui) untuk berbagai Jaringan Saraf Tiruan terkait audio
★ 1.246+0Perubahan bintang dalam 7 hari terakhir - #7★ 1.238-1Perubahan bintang dalam 7 hari terakhir
- #8
HunyuanVideo-Foley: Difusi Multimodal dengan Penyelarasan Representasi untuk Pembuatan Audio Foley Berkualitas Tinggi.
★ 1.058+4Perubahan bintang dalam 7 hari terakhir - #9
[ICLR 2026] TangoFlux: Pembuatan Teks ke Audio yang Sangat Cepat dan Akurat dengan Flow Matching
★ 882+0Perubahan bintang dalam 7 hari terakhir - #10
Implementasi PyTorch untuk Make-An-Audio (ICML'23) dengan Model Generatif Text-to-Audio
★ 668+0Perubahan bintang dalam 7 hari terakhir - #11★ 632+1Perubahan bintang dalam 7 hari terakhir
- #12
🔥🔥🔥 Daftar kurasi makalah tentang generasi multimodal berbasis LLM (gambar, video, 3D, dan audio).
★ 552+0Perubahan bintang dalam 7 hari terakhir - #13
Proyek Sumber Terbuka untuk Menyatukan Pemrosesan dan Pembuatan Audio
★ 513+3Perubahan bintang dalam 7 hari terakhir