speech-synthesis
Dépôts open source suivis étiquetés speech-synthesis, triés par étoiles.
- #31
Une application ChatGPT open-source avec une interface vocale.
★ 2 350-1Évolution des étoiles sur les 7 derniers jours - #32
Synthèse vocale rapide et contrôlable pour plus de 7000 langues.
★ 2 207-1Évolution des étoiles sur les 7 derniers jours - #33★ 1 836+1Évolution des étoiles sur les 7 derniers jours
- #34
Implémentation non officielle de Parallel WaveGAN (incluant MelGAN, Multi-band MelGAN, HiFi-GAN et StyleMelGAN) avec PyTorch.
★ 1 646+1Évolution des étoiles sur les 7 derniers jours - #35
Application Linux Speech Note. Prise de notes, lecture et traduction avec reconnaissance vocale, synthèse vocale et traduction automatique hors ligne.
★ 1 622+8Évolution des étoiles sur les 7 derniers jours - #36
Nœuds personnalisés étendant les capacités de Comfyui.
★ 1 525+1Évolution des étoiles sur les 7 derniers jours - #37★ 1 498+0Évolution des étoiles sur les 7 derniers jours
- #38
Pré-entraînement parole-texte multimodal unifié pour le traitement du langage parlé
★ 1 449+0Évolution des étoiles sur les 7 derniers jours - #39
Auto-hébergez le puissant modèle TTS Chatterbox. Ce serveur propose une interface Web conviviale, des points de terminaison API flexibles (compatibles OpenAI), des voix prédéfinies, le clonage vocal et le traitement de texte à grande échelle pour les livres audio. Fonctionne en mode accéléré sur NVIDIA (CUDA), AMD (ROCm) et CPU.
★ 1 427+1Évolution des étoiles sur les 7 derniers jours - #40
Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.
★ 1 399+0Évolution des étoiles sur les 7 derniers jours - #41
Restauration de parole générale
★ 1 375+0Évolution des étoiles sur les 7 derniers jours - #42★ 1 339+0Évolution des étoiles sur les 7 derniers jours
- #43
StreamSpeech est un modèle tout-en-un fluide pour la reconnaissance vocale, la traduction et la synthèse vocale, en mode hors ligne et simultané.
★ 1 288+0Évolution des étoiles sur les 7 derniers jours - #44
Modèle de synthèse vocale basé sur le Flow Matching avec contrôle de style piloté par emoji
★ 1 228+4Évolution des étoiles sur les 7 derniers jours - #45★ 1 227+1Évolution des étoiles sur les 7 derniers jours
- #46
Irina, un assistant vocal russe fonctionnant hors ligne, prenant en charge des compétences via des plugins.
★ 1 153+0Évolution des étoiles sur les 7 derniers jours - #47
Vtuber IA pour le streaming sur Youtube/Twitch
★ 1 116+2Évolution des étoiles sur les 7 derniers jours - #48
AutoVC : Transfert de style vocal Zero-Shot avec uniquement une perte d'auto-encodeur.
★ 1 100+0Évolution des étoiles sur les 7 derniers jours - #49
YourTTS : vers une synthèse vocale multi-locuteur et une conversion de voix Zero-Shot pour tous.
★ 1 054+0Évolution des étoiles sur les 7 derniers jours - #50
Exemple de code pour l'API Microsoft Text-to-Speech dans plusieurs langages, faisant partie des Cognitive Services.
★ 1 014+3Évolution des étoiles sur les 7 derniers jours - #51
Générateur de livres audio multi-voix propulsé par l'IA : annotation de script par LLM, clonage vocal, conception de voix, entraînement LoRA, contrôle de style par ligne et exportation en MP3, M4B chapitré ou multipiste Audacity. Basé sur Qwen3-TTS.
★ 1 000+20Évolution des étoiles sur les 7 derniers jours - #52
NISQA - Évaluation non intrusive de la qualité de la parole et du naturel de la synthèse vocale (TTS).
★ 972+3Évolution des étoiles sur les 7 derniers jours - #53
Rendre les voix TTS naturelles d'Azure accessibles à toute application compatible SAPI 5.
★ 934+13Évolution des étoiles sur les 7 derniers jours - #54
Un système de synthèse vocale (TTS) open source basé sur des LLM.
★ 919+1Évolution des étoiles sur les 7 derniers jours - #55
Un LLM vocal qui s'exécute localement sur votre ordinateur sans nécessiter de connexion internet.
★ 891+2Évolution des étoiles sur les 7 derniers jours - #56
DiffWave est un vocodeur neuronal et un synthétiseur de forme d'onde rapide et de haute qualité.
★ 884+0Évolution des étoiles sur les 7 derniers jours - #57
Confucius4-TTS : un moteur de synthèse vocale (TTS) multilingue et inter-lingue zero-shot.
★ 794+10Évolution des étoiles sur les 7 derniers jours - #58
Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.
★ 759+10Évolution des étoiles sur les 7 derniers jours - #59
Thorsten-Voice : une voix TTS allemande gratuite, utilisable hors ligne et de haute qualité, accessible à tous les projets sans contraintes de licence.
★ 729+1Évolution des étoiles sur les 7 derniers jours - #60
Papers INTERSPEECH 2023-2024 : une collection complète de papiers influents et passionnants de la conférence INTERSPEECH 2023-24. Découvrez les dernières avancées dans le traitement du discours et du langage. Code inclus. Étoinez le dépôt pour soutenir l'avancement de la technologie vocale !
★ 684+0Évolution des étoiles sur les 7 derniers jours