text-to-speech
Dépôts open source suivis étiquetés text-to-speech, triés par étoiles.
- #91
Intégration de nœuds personnalisés pour ComfyUI dédiée à la synthèse vocale (TTS) et à la conversion de voix multi-moteurs et multilingue. Supporte RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2, 3 et VibeVoice avec gestion des durées illimitées, timing SRT et outils audio.
★ 1 187+0Évolution des étoiles sur les 7 derniers jours - #92
Un laboratoire pratique pour construire, tester et évaluer des applications avec le framework Foundation Models d'Apple.
★ 1 178+0Évolution des étoiles sur les 7 derniers jours - #93★ 1 173+0Évolution des étoiles sur les 7 derniers jours
- #94
Boîte à outils vocale IA pour Apple Silicon — ASR, TTS, speech-to-speech, VAD et diarisation propulsés par MLX et CoreML
★ 1 161+0Évolution des étoiles sur les 7 derniers jours - #95
Le système d'auto-codage pour votre application — SDK Alan AI pour Cordova
★ 1 132+0Évolution des étoiles sur les 7 derniers jours - #96
SGLang-Omni permet un service haute performance pour les modèles TTS, ASR, vocaux et omnimodaux.
★ 1 118+56Évolution des étoiles sur les 7 derniers jours - #97
Studio d'IA local non censuré pour Windows, Linux et macOS. Interface graphique sans configuration pour la génération d'images, les LLM GGUF, la synthèse vocale et la reconnaissance vocale.
★ 1 118+13Évolution des étoiles sur les 7 derniers jours - #98
SDK d'IA vocale open-source. L'alternative à Vapi/Retell pour les développeurs souhaitant maîtriser leur stack. Donnez un numéro de téléphone à votre agent IA en 4 lignes — Python et TypeScript, sous licence MIT, compatible Twilio, Telnyx et Plivo.
★ 1 051+7Évolution des étoiles sur les 7 derniers jours - #99
Exemple de code pour l'API Microsoft Text-to-Speech dans plusieurs langages, faisant partie des Cognitive Services.
★ 1 014+1Évolution des étoiles sur les 7 derniers jours - #100
Générateur de livres audio multi-voix propulsé par l'IA : annotation de script par LLM, clonage vocal, conception de voix, entraînement LoRA, contrôle de style par ligne et exportation en MP3, M4B chapitré ou multipiste Audacity. Basé sur Qwen3-TTS.
★ 1 000+10Évolution des étoiles sur les 7 derniers jours - #101
Un puissant modèle d'édition audio basé sur l'apprentissage par renforcement et un LLM de 3 milliards de paramètres, spécialisé dans l'édition des émotions, du style de parole et des paralinguistiques, avec des capacités robustes de synthèse vocale zero-shot
★ 973+1Évolution des étoiles sur les 7 derniers jours - #102
NISQA - Évaluation non intrusive de la qualité de la parole et du naturel de la synthèse vocale (TTS).
★ 972+4Évolution des étoiles sur les 7 derniers jours - #103
Traitement vocal Botium
★ 943+0Évolution des étoiles sur les 7 derniers jours - #104
Rendre les voix TTS naturelles d'Azure accessibles à toute application compatible SAPI 5.
★ 934+7Évolution des étoiles sur les 7 derniers jours - #105
Client API REST Vonage pour PHP. Support API pour SMS, voix, synthèse vocale, numéros, vérification (2FA) et plus encore.
★ 931-1Évolution des étoiles sur les 7 derniers jours - #106
Un système de synthèse vocale (TTS) open source basé sur des LLM.
★ 919-1Évolution des étoiles sur les 7 derniers jours - #107
Journal de bord et carte stellaire 3D pour Elite Dangerous.
★ 900+4Évolution des étoiles sur les 7 derniers jours - #108
DiffWave est un vocodeur neuronal et un synthétiseur de forme d'onde rapide et de haute qualité.
★ 884-1Évolution des étoiles sur les 7 derniers jours - #109★ 868+2Évolution des étoiles sur les 7 derniers jours
- #110
Lecteur d'eBook en terminal avec synthèse vocale de qualité livre audio — Prend en charge EPUB, PDF, DOCX, HTML, RTF, TXT et MD.
★ 805+1Évolution des étoiles sur les 7 derniers jours - #111
🎤 Lobe TTS - Une bibliothèque TTS/STT fiable et de haute qualité pour serveur et navigateur.
★ 805-1Évolution des étoiles sur les 7 derniers jours - #112
Moteur de synthèse vocale (TTS) Android léger et hors ligne, permettant le clonage de voix et la lecture de texte haute fidélité à l'échelle du système.
★ 804+5Évolution des étoiles sur les 7 derniers jours - #113
Speech to Text to Speech. Chanson en cours de lecture. Envoie du texte sous forme de messages OSC vers VRChat pour affichage sur l'avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 804+5Évolution des étoiles sur les 7 derniers jours - #114
Éditeur vidéo open-source et local-first, permettant aux créateurs et aux agents IA d'éditer une même timeline en temps réel.
★ 798+82Évolution des étoiles sur les 7 derniers jours - #115
Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.
★ 794+73Évolution des étoiles sur les 7 derniers jours - #116
Confucius4-TTS : un moteur de synthèse vocale (TTS) multilingue et inter-lingue zero-shot.
★ 794+6Évolution des étoiles sur les 7 derniers jours - #117
Chatbot vocal local pour des conversations engageantes, propulsé par Ollama, Hugging Face Transformers et Coqui TTS Toolkit
★ 788+1Évolution des étoiles sur les 7 derniers jours - #118
Un SDK Swift modulaire pour le traitement audio avec MLX sur Apple Silicon
★ 774+5Évolution des étoiles sur les 7 derniers jours - #119
Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.
★ 759+7Évolution des étoiles sur les 7 derniers jours - #120
Système de communication améliorée et alternative (CAA) avec synthèse vocale pour le navigateur
★ 756+9Évolution des étoiles sur les 7 derniers jours