voice-cloning
Dépôts open source suivis étiquetés voice-cloning, triés par étoiles.
- #31
Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.
★ 759+7Évolution des étoiles sur les 7 derniers jours - #32
MimikaStudio - Une application locale pour macOS (Apple Silicon) avec prise en charge d'agents MCP.
★ 735+4Évolution des étoiles sur les 7 derniers jours - #33
API locale de texte‑à‑parole (TTS) compatible OpenAI utilisant Chatterbox, permettant aux utilisateurs de générer de la parole clonée partout où l'API OpenAI est utilisée (par ex. Open WebUI, AnythingLLM, etc.)
★ 677+1Évolution des étoiles sur les 7 derniers jours - #34
Transformez des PDF et des EPUB en livres audio ; des sous-titres ou des vidéos en vidéos doublées (avec traduction), et plus encore. Gratuitement. Pandrator utilise des modèles locaux, incluant le clonage de voix (instantané, amélioré par RVC, affinage XTTS) et le traitement par LLM. Il ambitionne d'être une application conviviale avec une interface graphique, un installateur et des packages tout-en-un.
★ 620+3Évolution des étoiles sur les 7 derniers jours - #35
YouDub est un outil open source conçu pour automatiser la traduction et le doublage de vidéos YouTube de qualité afin de les publier sur Internet. Cet outil utilise la reconnaissance vocale par IA pour transcrire l'audio en texte, traduit ensuite ce texte en chinois via un grand modèle linguistique, puis convertit le texte chinois en audio grâce au clonage vocal par IA. Il est ainsi possible de créer des vidéos doublées en chinois dotées de la voix originale du créateur.
★ 615-1Évolution des étoiles sur les 7 derniers jours - #36
Nœud personnalisé ComfyUI pour VibeVoice TTS. Audio conversationnel expressif, long et multi-locuteur
★ 596-1Évolution des étoiles sur les 7 derniers jours - #37
Version modifiée de Chatterbox acceptant des fichiers texte en entrée sans restriction de caractères. Je l'utilise pour créer des livres audio, en particulier pour mes enfants.
★ 575-1Évolution des étoiles sur les 7 derniers jours - #38
Exécutez Qwen3-TTS text-to-speech localement sur Mac (M1/M2/M3/M4). Clonage de voix, design vocal, voix personnalisées. 100 % hors ligne via MLX.
★ 561+2Évolution des étoiles sur les 7 derniers jours - #39
Le premier modèle de dialogue parlé en temps réel de bout en bout open-source au monde avec clonage de voix personnalisé.
★ 550+0Évolution des étoiles sur les 7 derniers jours - #40
Nœuds OmniVoice TTS pour ComfyUI - Synthèse vocale multilingue zero-shot avec clonage de voix, conception vocale et dialogue multi-locuteurs
★ 545+5Évolution des étoiles sur les 7 derniers jours - #41
Nœud ComfyUI pour une parole hautement expressive et un clonage vocal zero-shot réaliste
★ 509-1Évolution des étoiles sur les 7 derniers jours