tts
Dépôts open source suivis étiquetés tts, triés par étoiles.
- #61
Lecteur de livres électroniques multiplateforme alimenté par l'IA avec recherche sémantique, chat RAG, stockage vectoriel local, notes, synthèse vocale (TTS) et synchronisation WebDAV.
★ 2 305+24Évolution des étoiles sur les 7 derniers jours - #62
Outil open-source de synthèse vocale (TTS) prenant en charge les textes longs et le doublage multi-rôles.
★ 2 296+7Évolution des étoiles sur les 7 derniers jours - #63
Implémentation PyTorch de VALL-E (Text-To-Speech Zero-Shot), démo reproduite https://lifeiteng.github.io/valle/index.html
★ 2 215+0Évolution des étoiles sur les 7 derniers jours - #64
Un moteur d'inférence tout-en-un en C++ pur pour les modèles audio, propulsé par ggml. Prend en charge TTS, STT, VAD, conversion vocale, génération musicale et plus encore, avec des performances hautement optimisées. Aucune dépendance Python.
★ 2 214+115Évolution des étoiles sur les 7 derniers jours - #65
Synthèse vocale rapide et contrôlable pour plus de 7000 langues.
★ 2 207-1Évolution des étoiles sur les 7 derniers jours - #66
Point de terminaison d'API de synthèse vocale gratuit et de haute qualité pour remplacer OpenAI, Azure ou ElevenLabs.
★ 2 075+5Évolution des étoiles sur les 7 derniers jours - #67
Convertisseur EPUB vers livre audio, optimisé pour Audiobookshelf, avec interface Web incluse
★ 2 064+1Évolution des étoiles sur les 7 derniers jours - #68
Jouets vocaux IA en temps réel avec plus de 100 modèles sur Arduino ESP32, utilisant des WebSockets sécurisés et des Edge Functions pour des compagnons et appareils IA.
★ 1 938+5Évolution des étoiles sur les 7 derniers jours - #69
Gestion de Yandex Station et d'autres appareils domotiques avec Alice depuis Home Assistant.
★ 1 917-1Évolution des étoiles sur les 7 derniers jours - #70★ 1 912+1Évolution des étoiles sur les 7 derniers jours
- #71
Workflow-to-APP, partage d'écran et vidéo flottante, GPT et 3D, reconnaissance vocale et TTS.
★ 1 861-2Évolution des étoiles sur les 7 derniers jours - #72★ 1 836+1Évolution des étoiles sur les 7 derniers jours
- #73
Un outil CLI de synthèse vocale utilisant le modèle Kokoro, prenant en charge plusieurs langues, voix (avec mixage) et divers formats d'entrée, y compris les livres EPUB et les documents PDF.
★ 1 835+14Évolution des étoiles sur les 7 derniers jours - #74★ 1 760+3Évolution des étoiles sur les 7 derniers jours
- #75
Bailing est un assistant vocal conversationnel similaire à GPT-4o, utilisant ASR, LLM et TTS. Intègre des modèles comme DeepSeek R1 et openClaw, avec une latence réduite à 800ms, fonctionnant sur Mac et configurations légères.
★ 1 759+2Évolution des étoiles sur les 7 derniers jours - #76
Employé de génération vidéo entièrement automatisé par IA | Votre premier collègue AIGC. Discutez d'une idée. Obtenez un film.
★ 1 749+14Évolution des étoiles sur les 7 derniers jours - #77
Traduit automatiquement le texte d'une vidéo à partir d'un fichier de sous-titres, puis utilise des services vocaux IA pour créer une nouvelle piste audio doublée et traduite, synchronisée avec les timings des sous-titres.
★ 1 746-1Évolution des étoiles sur les 7 derniers jours - #78
Transformez un sujet en une vidéo explicative ou publicitaire de style Vox avec collage papier, automatisée de bout en bout sur Atlas Cloud et ffmpeg. Une compétence d'agent.
★ 1 698+67Évolution des étoiles sur les 7 derniers jours - #79★ 1 687+4Évolution des étoiles sur les 7 derniers jours
- #80
Découvrez Ava, l'agent WhatsApp.
★ 1 675+2Évolution des étoiles sur les 7 derniers jours - #81
Implémentation non officielle de Parallel WaveGAN (incluant MelGAN, Multi-band MelGAN, HiFi-GAN et StyleMelGAN) avec PyTorch.
★ 1 646+1Évolution des étoiles sur les 7 derniers jours - #82
Application Linux Speech Note. Prise de notes, lecture et traduction avec reconnaissance vocale, synthèse vocale et traduction automatique hors ligne.
★ 1 622+8Évolution des étoiles sur les 7 derniers jours - #83
Amica est une interface open source pour la communication interactive avec des personnages 3D, incluant la synthèse vocale et la reconnaissance vocale.
★ 1 591-2Évolution des étoiles sur les 7 derniers jours - #84
Une intégration complète de ComfyUI pour le modèle de synthèse vocale VibeVoice de Microsoft, permettant une synthèse vocale de haute qualité pour un ou plusieurs locuteurs directement dans vos flux de travail ComfyUI.
★ 1 555+4Évolution des étoiles sur les 7 derniers jours - #85★ 1 548+60Évolution des étoiles sur les 7 derniers jours
- #86
Application d'assistant Dicio pour Android
★ 1 463+3Évolution des étoiles sur les 7 derniers jours - #87
Exécutez des LLM locaux comme llama, deepseek-distill, kokoro et plus encore directement dans votre navigateur
★ 1 449+1Évolution des étoiles sur les 7 derniers jours - #88
Une application Python/Pytorch pour synthétiser facilement des voix humaines
★ 1 440+0Évolution des étoiles sur les 7 derniers jours - #89★ 1 437+0Évolution des étoiles sur les 7 derniers jours
- #90
Auto-hébergez le puissant modèle TTS Chatterbox. Ce serveur propose une interface Web conviviale, des points de terminaison API flexibles (compatibles OpenAI), des voix prédéfinies, le clonage vocal et le traitement de texte à grande échelle pour les livres audio. Fonctionne en mode accéléré sur NVIDIA (CUDA), AMD (ROCm) et CPU.
★ 1 427+1Évolution des étoiles sur les 7 derniers jours