Aller au contenu principal
buildradar
Sign in
Propriétaire · QwenAudio

QwenAudio

Dépôts open source suivis de QwenAudio, triés par étoiles.

6 dépôts
  • CosyVoice@QwenAudio

    Modèle multilingue de génération vocale à grande échelle, offrant des capacités complètes d'inférence, d'entraînement et de déploiement.

    23 426+498Évolution des étoiles sur les 7 derniers jours
  • SenseVoice@QwenAudio

    Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.

    9 209+53Évolution des étoiles sur les 7 derniers jours
  • qwen-audio-agent@QwenAudio

    Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.

    2 345+54Évolution des étoiles sur les 7 derniers jours
  • Fun-ASR@QwenAudio

    Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.

    1 512+14Évolution des étoiles sur les 7 derniers jours
  • ThinkSound@QwenAudio

    [NeurIPS 2025] Implémentation PyTorch de [ThinkSound], un framework unifié pour générer de l'audio à partir de n'importe quelle modalité, guidé par le raisonnement Chain-of-Thought (CoT).

    1 378+0Évolution des étoiles sur les 7 derniers jours
  • Fun-Audio-Chat@QwenAudio

    Fun-Audio-Chat est un grand modèle de langage audio conçu pour des interactions vocales naturelles à faible latence.

    1 002+5Évolution des étoiles sur les 7 derniers jours
← Retour au classement des propriétaires