QwenAudio
Dépôts open source suivis de QwenAudio, triés par étoiles.
- #1
Modèle multilingue de génération vocale à grande échelle, offrant des capacités complètes d'inférence, d'entraînement et de déploiement.
★ 23 426+498Évolution des étoiles sur les 7 derniers jours - #2
Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.
★ 9 209+53Évolution des étoiles sur les 7 derniers jours - #3
Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.
★ 2 345+54Évolution des étoiles sur les 7 derniers jours - #4
Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.
★ 1 512+14Évolution des étoiles sur les 7 derniers jours - #5
[NeurIPS 2025] Implémentation PyTorch de [ThinkSound], un framework unifié pour générer de l'audio à partir de n'importe quelle modalité, guidé par le raisonnement Chain-of-Thought (CoT).
★ 1 378+0Évolution des étoiles sur les 7 derniers jours - #6
Fun-Audio-Chat est un grand modèle de langage audio conçu pour des interactions vocales naturelles à faible latence.
★ 1 002+5Évolution des étoiles sur les 7 derniers jours