QwenAudio
Erfasste Open-Source-Repos von QwenAudio, sortiert nach Sternen.
- #1
Multilingualer großflächiges Sprachgenerierungsmodell, das Inference, Training und Bereitstellung in vollem Stack ermöglicht.
★ 23.426+498Sterne-Änderung der letzten 7 Tage - #2
Open-Source-Modell SenseVoiceSmall für ASR in Mandarin, Kantonesisch, Englisch, Japanisch und Koreanisch, Spracherkennung, Emotionserkennung und Audio-Ereigniserkennung.
★ 9.209+53Sterne-Änderung der letzten 7 Tage - #3
Eine Echtzeit-Sprachlaufzeitumgebung für KI-Agenten, die sie im Gespräch und aktiv hält.
★ 2.358+54Sterne-Änderung der letzten 7 Tage - #4
Open-Source-LLM-basiertes ASR-Modellfamilie für Chinesisch, Dialekte, Akzente und mehrsprachige Sprache, mit FunASR, vLLM, Streaming- und llama.cpp-Runtimes.
★ 1.512+14Sterne-Änderung der letzten 7 Tage - #5
[NeurIPS 2025] PyTorch-Implementierung von [ThinkSound], einem einheitlichen Framework zur Audiogenerierung aus beliebigen Modalitäten, gesteuert durch Chain-of-Thought (CoT)-Reasoning.
★ 1.378+0Sterne-Änderung der letzten 7 Tage - #6
Fun-Audio-Chat ist ein großes Audio-Sprachmodell, das für natürliche, latenzarme Sprachinteraktionen entwickelt wurde.
★ 1.002+5Sterne-Änderung der letzten 7 Tage