voice-cloning
Dépôts open source suivis étiquetés voice-cloning, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de voice-cloning sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés voice-cloning.
- #1
1 minute de données vocales suffit pour entraîner un bon modèle TTS ! (clonage vocal en quelques exemples)
★ 61 476+138Évolution des étoiles sur les 7 derniers jours - #2
Clonage de voix en 5 secondes pour générer n'importe quel discours en temps réel
★ 60 117-4Évolution des étoiles sur les 7 derniers jours - #3
🐸💬 - Une boîte à outils de deep learning pour la synthèse vocale (Text-to-Speech), éprouvée en recherche et en production.
★ 45 985+18Évolution des étoiles sur les 7 derniers jours - #4
VoxCPM2 : TTS sans tokenizer pour la génération de parole multilingue, la conception de voix créatives et le clonage vocal réaliste.
★ 36 595+345Évolution des étoiles sur les 7 derniers jours - #5
Modèle multilingue de génération vocale à grande échelle, offrant des capacités complètes d'inférence, d'entraînement et de déploiement.
★ 23 426+359Évolution des étoiles sur les 7 derniers jours - #6
Générez des livres audio à partir de livres numériques, avec clonage vocal et prise en charge de plus de 1158 langues.
★ 20 097+34Évolution des étoiles sur les 7 derniers jours - #7
Découpage, traduction, alignement et doublage de sous-titres de niveau Netflix - équipe de sous-titrage vidéo IA entièrement automatisée en un clic
★ 18 339+49Évolution des étoiles sur les 7 derniers jours - #8
VoiceStudio est l'alternative open source et entièrement locale à ElevenLabs : clonage vocal, design vocal, doublage vidéo, dictée, transcription et création de livres audio en 646 langues.
★ 14 835+2 880Évolution des étoiles sur les 7 derniers jours - #9
Interface Web Gradio pour créateurs et développeurs, intégrant des fonctionnalités clés de TTS (Edge-TTS, kokoro) et de clonage vocal zero-shot (E2 & F5-TTS, CosyVoice), avec traitement audio Whisper, téléchargement YouTube, isolation vocale Demucs et traduction multilingue.
★ 12 730+54Évolution des étoiles sur les 7 derniers jours - #10
Boîte à outils vocale facile à utiliser incluant l'apprentissage auto-supervisé, la reconnaissance vocale (ASR) SOTA/en continu avec ponctuation, la synthèse vocale (TTS) en continu avec interface textuelle, un système de vérification du locuteur, la traduction vocale de bout en bout et la détection de mots-clés. Lauréat du prix Best Demo à NAACL2022.
★ 12 676+5Évolution des étoiles sur les 7 derniers jours - #11
YuE : Modèle de fondation pour la génération de chansons complètes, similaire à Suno.ai mais en open source.
★ 6 416+8Évolution des étoiles sur les 7 derniers jours - #12
Outil open source de localisation vidéo par IA : automatise le téléchargement de vidéos YouTube/Bilibili, la reconnaissance et la traduction de sous-titres, le clonage vocal, le mixage audio et l'incrustation de sous-titres.
★ 5 404+25Évolution des étoiles sur les 7 derniers jours - #13
La famille MOSS‑TTS est une gamme de modèles open source de génération de parole et de son développée par MOSI.AI et l'équipe OpenMOSS. Conçue pour une haute fidélité et une grande expressivité dans des scénarios réels complexes, elle couvre la synthèse vocale longue durée stable, le dialogue multi-locuteur, la conception de voix et de personnages, les effets sonores environnementaux et le TTS en streaming temps réel.
★ 4 058+18Évolution des étoiles sur les 7 derniers jours - #14
Outil de conversion vocale simple et de haute qualité, axé sur la facilité d'utilisation et la performance
★ 3 674+14Évolution des étoiles sur les 7 derniers jours - #15★ 2 818+1Évolution des étoiles sur les 7 derniers jours
- #16
Un moteur d'inférence tout-en-un en C++ pur pour les modèles audio, propulsé par ggml. Prend en charge TTS, STT, VAD, conversion vocale, génération musicale et plus encore, avec des performances hautement optimisées. Aucune dépendance Python.
★ 2 214+115Évolution des étoiles sur les 7 derniers jours - #17★ 1 760+3Évolution des étoiles sur les 7 derniers jours
- #18
Serveur officiel MiniMax Model Context Protocol (MCP) permettant d'interagir avec des API puissantes de synthèse vocale, de génération d'images et de génération de vidéos.
★ 1 573+2Évolution des étoiles sur les 7 derniers jours - #19
Une intégration complète de ComfyUI pour le modèle de synthèse vocale VibeVoice de Microsoft, permettant une synthèse vocale de haute qualité pour un ou plusieurs locuteurs directement dans vos flux de travail ComfyUI.
★ 1 555+4Évolution des étoiles sur les 7 derniers jours - #20
Une application Python/Pytorch pour synthétiser facilement des voix humaines
★ 1 440+0Évolution des étoiles sur les 7 derniers jours - #21
Auto-hébergez le puissant modèle TTS Chatterbox. Ce serveur propose une interface Web conviviale, des points de terminaison API flexibles (compatibles OpenAI), des voix prédéfinies, le clonage vocal et le traitement de texte à grande échelle pour les livres audio. Fonctionne en mode accéléré sur NVIDIA (CUDA), AMD (ROCm) et CPU.
★ 1 427+1Évolution des étoiles sur les 7 derniers jours - #22
Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.
★ 1 399+0Évolution des étoiles sur les 7 derniers jours - #23
Générateur de podcasts IA pour épisodes bilingues et multilingues, alternative à NotebookLLM.
★ 1 289-1Évolution des étoiles sur les 7 derniers jours - #24
Une interface web pour différents réseaux de neurones liés à l'audio
★ 1 246+0Évolution des étoiles sur les 7 derniers jours - #25
Modèle de synthèse vocale basé sur le Flow Matching avec contrôle de style piloté par emoji
★ 1 228+4Évolution des étoiles sur les 7 derniers jours - #26
Intégration de nœuds personnalisés pour ComfyUI dédiée à la synthèse vocale (TTS) et à la conversion de voix multi-moteurs et multilingue. Supporte RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2, 3 et VibeVoice avec gestion des durées illimitées, timing SRT et outils audio.
★ 1 187+7Évolution des étoiles sur les 7 derniers jours - #27
Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.
★ 1 115+245Évolution des étoiles sur les 7 derniers jours - #28
Générateur de livres audio multi-voix propulsé par l'IA : annotation de script par LLM, clonage vocal, conception de voix, entraînement LoRA, contrôle de style par ligne et exportation en MP3, M4B chapitré ou multipiste Audacity. Basé sur Qwen3-TTS.
★ 996+17Évolution des étoiles sur les 7 derniers jours - #29
Un puissant modèle d'édition audio basé sur l'apprentissage par renforcement et un LLM de 3 milliards de paramètres, spécialisé dans l'édition des émotions, du style de parole et des paralinguistiques, avec des capacités robustes de synthèse vocale zero-shot
★ 971+1Évolution des étoiles sur les 7 derniers jours - #30
Moteur de synthèse vocale (TTS) Android léger et hors ligne, permettant le clonage de voix et la lecture de texte haute fidélité à l'échelle du système.
★ 801+2Évolution des étoiles sur les 7 derniers jours