speech-synthesis
Dépôts open source suivis étiquetés speech-synthesis, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de speech-synthesis sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés speech-synthesis.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
🐸💬 - Une boîte à outils de deep learning pour la synthèse vocale (Text-to-Speech), éprouvée en recherche et en production.
★ 45 985+18Évolution des étoiles sur les 7 derniers jours - #2
VoxCPM2 : TTS sans tokenizer pour la génération de parole multilingue, la conception de voix créatives et le clonage vocal réaliste.
★ 36 595+345Évolution des étoiles sur les 7 derniers jours - #3
Framework d'IA générative évolutif conçu pour les chercheurs et développeurs travaillant sur les grands modèles de langage, le multimodal et l'IA vocale (ASR et TTS).
★ 18 379+21Évolution des étoiles sur les 7 derniers jours - #4★ 17 476+1Évolution des étoiles sur les 7 derniers jours
- #5
Scripts de Deep Learning de pointe organisés par modèles - faciles à entraîner et à déployer avec une précision et des performances reproductibles sur une infrastructure de niveau entreprise.
★ 14 846+4Évolution des étoiles sur les 7 derniers jours - #6
TTS multilingue ultra-rapide fonctionnant localement sur l'appareil via ONNX.
★ 13 757+20Évolution des étoiles sur les 7 derniers jours - #7
Créez des agents vocaux avec des modèles open-source
★ 13 015+82Évolution des étoiles sur les 7 derniers jours - #8
Interface Web Gradio pour créateurs et développeurs, intégrant des fonctionnalités clés de TTS (Edge-TTS, kokoro) et de clonage vocal zero-shot (E2 & F5-TTS, CosyVoice), avec traitement audio Whisper, téléchargement YouTube, isolation vocale Demucs et traduction multilingue.
★ 12 730+54Évolution des étoiles sur les 7 derniers jours - #9
Boîte à outils vocale facile à utiliser incluant l'apprentissage auto-supervisé, la reconnaissance vocale (ASR) SOTA/en continu avec ponctuation, la synthèse vocale (TTS) en continu avec interface textuelle, un système de vérification du locuteur, la traduction vocale de bout en bout et la détection de mots-clés. Lauréat du prix Best Demo à NAACL2022.
★ 12 676+5Évolution des étoiles sur les 7 derniers jours - #10
Utilisez le service de synthèse vocale en ligne de Microsoft Edge depuis Python sans avoir besoin de Microsoft Edge, de Windows ou d'une clé API.
★ 11 847+29Évolution des étoiles sur les 7 derniers jours - #11
Amphion est une boîte à outils pour la génération audio, musicale et vocale. Son objectif est de soutenir la recherche reproductible et d'aider les chercheurs et ingénieurs débutants à se lancer dans la recherche et le développement liés à la génération audio, musicale et vocale.
★ 10 276+1Évolution des étoiles sur les 7 derniers jours - #12★ 9 949+3Évolution des étoiles sur les 7 derniers jours
- #13
Fork de so-vits-svc avec prise en charge du temps réel, interface améliorée et fonctionnalités supplémentaires.
★ 9 329+3Évolution des étoiles sur les 7 derniers jours - #14
EmotiVoice 😊 : un moteur TTS multi-voix contrôlé par prompts
★ 8 522-1Évolution des étoiles sur les 7 derniers jours - #15
Une bibliothèque de synthèse vocale (TTS), de reconnaissance vocale (STT) et de conversion parole-à-parole (STS) basée sur le framework MLX d'Apple, offrant une analyse vocale efficace sur Apple Silicon.
★ 7 826+23Évolution des étoiles sur les 7 derniers jours - #16
eSpeak NG est un synthétiseur vocal open source prenant en charge plus d'une centaine de langues et d'accents.
★ 6 802+13Évolution des étoiles sur les 7 derniers jours - #17
StyleTTS 2 : Vers une synthèse vocale de niveau humain grâce à la diffusion de style et à l'entraînement antagoniste avec de grands modèles de langage vocal
★ 6 342+3Évolution des étoiles sur les 7 derniers jours - #18
Silero Models : modèles de synthèse vocale pré-entraînés rendus extrêmement simples.
★ 6 084-1Évolution des étoiles sur les 7 derniers jours - #19
Générer des livres audio à partir d'EPUB, PDF et texte avec des sous-titres synchronisés.
★ 5 831+45Évolution des étoiles sur les 7 derniers jours - #20
DiffSinger : synthèse de voix chantée via un mécanisme de diffusion superficielle (SVS & TTS) ; AAAI 2022 ; code officiel.
★ 4 855+3Évolution des étoiles sur les 7 derniers jours - #21
Un système de synthèse vocale open source construit par inversion de Whisper.
★ 4 645+3Évolution des étoiles sur les 7 derniers jours - #22★ 4 258+18Évolution des étoiles sur les 7 derniers jours
- #23
Modèle fondamental pour une synthèse vocale (TTS) expressive et naturelle.
★ 4 203-1Évolution des étoiles sur les 7 derniers jours - #24
Convertit le texte en parole en temps réel.
★ 4 021+2Évolution des étoiles sur les 7 derniers jours - #25
TensorFlowTTS : Synthèse vocale de pointe en temps réel pour TensorFlow 2 (supporte l'anglais, le français, le coréen, le chinois, l'allemand et est facilement adaptable à d'autres langues).
★ 3 996+0Évolution des étoiles sur les 7 derniers jours - #26★ 2 864+0Évolution des étoiles sur les 7 derniers jours
- #27★ 2 818+1Évolution des étoiles sur les 7 derniers jours
- #28★ 2 583+0Évolution des étoiles sur les 7 derniers jours
- #29
Synthèse vocale (TTS) en vietnamien avec clonage de voix instantané, exécution locale sur appareil, inférence CPU en temps réel et qualité audio 24kHz.
★ 2 468+21Évolution des étoiles sur les 7 derniers jours - #30
HiFi-GAN : Réseaux antagonistes génératifs pour une synthèse vocale efficace et haute fidélité
★ 2 367+0Évolution des étoiles sur les 7 derniers jours