Aller au contenu principal
buildradar
Sign in
Sujet · speech

speech

Dépôts open source suivis étiquetés speech, triés par étoiles.

74 dépôts
  • TTS-papers@coqui-ai

    🐸 Collection d'articles de recherche sur la synthèse vocale (TTS).

    734+1Évolution des étoiles sur les 7 derniers jours
  • MASR@yeyupiaoling

    Framework de reconnaissance vocale automatique (ASR) en PyTorch, compatible avec les modes streaming et non-streaming, supportant les modèles Conformer, Squeezeformer et DeepSpeech2, ainsi que diverses méthodes d'augmentation de données.

    727+0Évolution des étoiles sur les 7 derniers jours
  • FreeVC@OlaWod

    FreeVC : Vers une conversion de voix one-shot de haute qualité sans texte.

    716+0Évolution des étoiles sur les 7 derniers jours
  • openspeech@openspeech-team

    Boîte à outils open source pour la reconnaissance vocale de bout en bout utilisant PyTorch-Lightning et Hydra.

    714+0Évolution des étoiles sur les 7 derniers jours
  • BabelDuck@Orenoid

    Application de pratique de conversation en IA adaptée aux débutants

    693+1Évolution des étoiles sur les 7 derniers jours
  • chatterbox-tts-api@travisvn

    API locale de texte‑à‑parole (TTS) compatible OpenAI utilisant Chatterbox, permettant aux utilisateurs de générer de la parole clonée partout où l'API OpenAI est utilisée (par ex. Open WebUI, AnythingLLM, etc.)

    677+6Évolution des étoiles sur les 7 derniers jours
  • MOSS-Audio@OpenMOSS

    MOSS-Audio est un modèle de fondation open source pour la compréhension audio unifiée, permettant la gestion de la parole, du son, de la musique, du sous-titrage, des questions-réponses et du raisonnement dans des scénarios réels.

    656+5Évolution des étoiles sur les 7 derniers jours
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) pour Node avec détection de mots-clés hors ligne

    638+0Évolution des étoiles sur les 7 derniers jours
  • Laboratoires, entreprises, ressources et stages dans le domaine de la voix, recommandations et candidatures spontanées bienvenues

    610+1Évolution des étoiles sur les 7 derniers jours
  • Une liste de jeux de données de réponses impulsionnelles de salles publiquement disponibles et de scripts pour les télécharger.

    609+3Évolution des étoiles sur les 7 derniers jours
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard : une plateforme de benchmarking vaste, robuste et complète pour la reconnaissance automatique de la parole.

    553+3Évolution des étoiles sur les 7 derniers jours
  • tacotron@google

    Échantillons audio accompagnant les publications relatives à Tacotron, un modèle de synthèse vocale de bout en bout.

    539+0Évolution des étoiles sur les 7 derniers jours
  • knn-vc@bshall

    Conversion de voix utilisant uniquement les plus proches voisins

    524+1Évolution des étoiles sur les 7 derniers jours
  • StarGANv2-VC@yl4579

    StarGANv2-VC : un framework non supervisé et non parallèle pour la conversion de voix naturelle.

    522+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets