tts
Dépôts open source suivis étiquetés tts, triés par étoiles.
- #31
Une interface web locale simple utilisant ChatTTS pour la synthèse vocale, avec prise en charge d'une interface API externe.
★ 7 648+7Évolution des étoiles sur les 7 derniers jours - #32
Bibliothèque de synthèse vocale multilingue de haute qualité par MyShell.ai. Supporte l'anglais, l'espagnol, le français, le chinois, le japonais et le coréen.
★ 7 616+8Évolution des étoiles sur les 7 derniers jours - #33
wukong-robot est un robot de conversation vocale et une enceinte intelligente simple, flexible et élégante, prenant en charge les dialogues multi-tours ChatGPT et potentiellement la première interface cerveau-machine open source.
★ 7 126+1Évolution des étoiles sur les 7 derniers jours - #34
StyleTTS 2 : Vers une synthèse vocale de niveau humain grâce à la diffusion de style et à l'entraînement antagoniste avec de grands modèles de langage vocal
★ 6 342+6Évolution des étoiles sur les 7 derniers jours - #35
Vers une synthèse vocale au rendu naturel
★ 6 324+10Évolution des étoiles sur les 7 derniers jours - #36
Outil de synthèse vocale Microsoft, construit avec Electron, Vue, ElementPlus et Vite.
★ 6 103+2Évolution des étoiles sur les 7 derniers jours - #37
Silero Models : modèles de synthèse vocale pré-entraînés rendus extrêmement simples.
★ 6 084+2Évolution des étoiles sur les 7 derniers jours - #38
Générer des livres audio à partir d'EPUB, PDF et texte avec des sous-titres synchronisés.
★ 5 831+59Évolution des étoiles sur les 7 derniers jours - #39
Wrapper compatible OpenAI conteneurisé pour la synthèse vocale Kokoro-82M, avec support multiplateforme CPU, GPU AMD et NVIDIA PyTorch ; inclut le multi-locuteur, le mixage vocal, l'assemblage automatique, les horodatages de sous-titres, SSML et une interface web de lecture.
★ 5 399+25Évolution des étoiles sur les 7 derniers jours - #40
Moteur vidéo AIGC polyvalent : du script au film fini dans un seul pipeline — séries, publicités, vidéos produits, jeux otome, et plus encore.
★ 4 900+537Évolution des étoiles sur les 7 derniers jours - #41
DiffSinger : synthèse de voix chantée via un mécanisme de diffusion superficielle (SVS & TTS) ; AAAI 2022 ; code officiel.
★ 4 855+4Évolution des étoiles sur les 7 derniers jours - #42
Un système de synthèse vocale open source construit par inversion de Whisper.
★ 4 645+6Évolution des étoiles sur les 7 derniers jours - #43
Application TTS pour Android intégrant l'interface de démonstration Microsoft, avec prise en charge des requêtes HTTP personnalisées, importation d'autres moteurs TTS locaux, reconnaissance de narration/dialogue basée sur les guillemets chinois, ainsi que des fonctions de réessai automatique, de configuration de secours et de remplacement de texte.
★ 4 488+6Évolution des étoiles sur les 7 derniers jours - #44
MOSS-TTS-Nano est un modèle de synthèse vocale multilingue miniature open source développé par MOSI.AI et l'équipe OpenMOSS. Avec seulement 0,1 milliard de paramètres, il est conçu pour la génération de parole en temps réel, peut s'exécuter directement sur CPU sans GPU, et maintient une pile de déploiement suffisamment simple pour des démonstrations locales, le service web et l'intégration légère dans des produits.
★ 4 282+34Évolution des étoiles sur les 7 derniers jours - #45
Modèle fondamental pour une synthèse vocale (TTS) expressive et naturelle.
★ 4 203-2Évolution des étoiles sur les 7 derniers jours - #46
TensorFlowTTS : Synthèse vocale de pointe en temps réel pour TensorFlow 2 (supporte l'anglais, le français, le coréen, le chinois, l'allemand et est facilement adaptable à d'autres langues).
★ 3 996+1Évolution des étoiles sur les 7 derniers jours - #47
Streamer-Sales 销冠 —— LLM pour le live shopping. Un modèle capable de présenter des produits en stimulant l'intention d'achat selon leurs caractéristiques. Inclut un processus de génération de données, l'accélération d'inférence avec LMDeploy, RAG, TTS, avatars numériques, agents avec recherche web, ASR, frontend Vue et backend FastAPI avec déploiement Docker-compose.
★ 3 764+3Évolution des étoiles sur les 7 derniers jours - #48
Outil de conversion vocale simple et de haute qualité, axé sur la facilité d'utilisation et la performance
★ 3 674+28Évolution des étoiles sur les 7 derniers jours - #49
Une interface web unique Gradio + React avec des extensions pour ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T et Bark !
★ 3 250+6Évolution des étoiles sur les 7 derniers jours - #50
[AutoArk] GPA (General Purpose Audio) permet la reconnaissance vocale (ASR), la synthèse vocale (TTS) et la conversion de voix avec un seul modèle compact.
★ 3 061+283Évolution des étoiles sur les 7 derniers jours - #51
openctp fournit des interfaces compatibles CTP API pour divers courtiers tels que CTP, XTP, TORA, OST, EMT, TWS, TAP et QDP, permettant une intégration transparente. Il propose également un environnement de simulation basé sur TTS, disponible 24h/24 et 7j/7 pour le trading quantitatif.
★ 2 920+10Évolution des étoiles sur les 7 derniers jours - #52★ 2 864+0Évolution des étoiles sur les 7 derniers jours
- #53
aeneas est une bibliothèque Python/C et un ensemble d'outils pour synchroniser automatiquement l'audio et le texte (alignement forcé)
★ 2 862-1Évolution des étoiles sur les 7 derniers jours - #54
FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Entraînement, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutoriels, Guides, Cours, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, Clonage de voix, IA, Actualités IA, ML, Actualités ML, Tech, Kohya, Midjourney.
★ 2 762+3Évolution des étoiles sur les 7 derniers jours - #55
TTS avec kokoro et onnx runtime.
★ 2 694+12Évolution des étoiles sur les 7 derniers jours - #56
Bibliothèque Python et outil CLI pour interagir avec l'API de synthèse vocale de Google Translate.
★ 2 628+1Évolution des étoiles sur les 7 derniers jours - #57★ 2 586+2Évolution des étoiles sur les 7 derniers jours
- #58★ 2 583+0Évolution des étoiles sur les 7 derniers jours
- #59
Synthèse vocale (TTS) en vietnamien avec clonage de voix instantané, exécution locale sur appareil, inférence CPU en temps réel et qualité audio 24kHz.
★ 2 468+40Évolution des étoiles sur les 7 derniers jours - #60
HiFi-GAN : Réseaux antagonistes génératifs pour une synthèse vocale efficace et haute fidélité
★ 2 367+0Évolution des étoiles sur les 7 derniers jours