speech
Dépôts open source suivis étiquetés speech, triés par étoiles.
- #61
🐸 Collection d'articles de recherche sur la synthèse vocale (TTS).
★ 734+1Évolution des étoiles sur les 7 derniers jours - #62
Framework de reconnaissance vocale automatique (ASR) en PyTorch, compatible avec les modes streaming et non-streaming, supportant les modèles Conformer, Squeezeformer et DeepSpeech2, ainsi que diverses méthodes d'augmentation de données.
★ 727+0Évolution des étoiles sur les 7 derniers jours - #63★ 716+0Évolution des étoiles sur les 7 derniers jours
- #64
Boîte à outils open source pour la reconnaissance vocale de bout en bout utilisant PyTorch-Lightning et Hydra.
★ 714+0Évolution des étoiles sur les 7 derniers jours - #65★ 693+1Évolution des étoiles sur les 7 derniers jours
- #66
API locale de texte‑à‑parole (TTS) compatible OpenAI utilisant Chatterbox, permettant aux utilisateurs de générer de la parole clonée partout où l'API OpenAI est utilisée (par ex. Open WebUI, AnythingLLM, etc.)
★ 677+6Évolution des étoiles sur les 7 derniers jours - #67
MOSS-Audio est un modèle de fondation open source pour la compréhension audio unifiée, permettant la gestion de la parole, du son, de la musique, du sous-titrage, des questions-réponses et du raisonnement dans des scénarios réels.
★ 656+5Évolution des étoiles sur les 7 derniers jours - #68
:speech_balloon: /so.nus/ STT (speech to text) pour Node avec détection de mots-clés hors ligne
★ 638+0Évolution des étoiles sur les 7 derniers jours - #69
Laboratoires, entreprises, ressources et stages dans le domaine de la voix, recommandations et candidatures spontanées bienvenues
★ 610+1Évolution des étoiles sur les 7 derniers jours - #70
Une liste de jeux de données de réponses impulsionnelles de salles publiquement disponibles et de scripts pour les télécharger.
★ 609+3Évolution des étoiles sur les 7 derniers jours - #71
SpeechIO Leaderboard : une plateforme de benchmarking vaste, robuste et complète pour la reconnaissance automatique de la parole.
★ 553+3Évolution des étoiles sur les 7 derniers jours - #72
Échantillons audio accompagnant les publications relatives à Tacotron, un modèle de synthèse vocale de bout en bout.
★ 539+0Évolution des étoiles sur les 7 derniers jours - #73★ 524+1Évolution des étoiles sur les 7 derniers jours
- #74
StarGANv2-VC : un framework non supervisé et non parallèle pour la conversion de voix naturelle.
★ 522+0Évolution des étoiles sur les 7 derniers jours