QwenAudio
Repositori open source terpantau milik QwenAudio, diurutkan berdasarkan bintang.
- #1
Model generasi suara besar multibahasa, menyediakan kemampuan full-stack untuk inferensi, pelatihan, dan penerapan.
★ 23.426+498Perubahan bintang dalam 7 hari terakhir - #2
Model SenseVoiceSmall sumber terbuka untuk ASR bahasa Mandarin, Kanton, Inggris, Jepang, dan Korea, identifikasi bahasa, pengenalan emosi, dan deteksi peristiwa audio.
★ 9.209+53Perubahan bintang dalam 7 hari terakhir - #3
Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.
★ 2.342+54Perubahan bintang dalam 7 hari terakhir - #4
Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.
★ 1.512+14Perubahan bintang dalam 7 hari terakhir - #5
[NeurIPS 2025] Implementasi PyTorch dari [ThinkSound], kerangka kerja terpadu untuk menghasilkan audio dari modalitas apa pun, dipandu oleh penalaran Chain-of-Thought (CoT).
★ 1.378+0Perubahan bintang dalam 7 hari terakhir - #6
Fun-Audio-Chat adalah Large Audio Language Model yang dibangun untuk interaksi suara yang alami dan latensi rendah.
★ 1.002+5Perubahan bintang dalam 7 hari terakhir