Aller au contenu principal
buildradar
Se connecter
Sujet · voice-cloning

voice-cloning

Dépôts open source suivis étiquetés voice-cloning, triés par étoiles.

41 dépôts
  • vui@fluxions-ai

    Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.

    759+7Évolution des étoiles sur les 7 derniers jours
  • MimikaStudio@BoltzmannEntropy

    MimikaStudio - Une application locale pour macOS (Apple Silicon) avec prise en charge d'agents MCP.

    735+4Évolution des étoiles sur les 7 derniers jours
  • chatterbox-tts-api@travisvn

    API locale de texte‑à‑parole (TTS) compatible OpenAI utilisant Chatterbox, permettant aux utilisateurs de générer de la parole clonée partout où l'API OpenAI est utilisée (par ex. Open WebUI, AnythingLLM, etc.)

    677+1Évolution des étoiles sur les 7 derniers jours
  • Pandrator@lukaszliniewicz

    Transformez des PDF et des EPUB en livres audio ; des sous-titres ou des vidéos en vidéos doublées (avec traduction), et plus encore. Gratuitement. Pandrator utilise des modèles locaux, incluant le clonage de voix (instantané, amélioré par RVC, affinage XTTS) et le traitement par LLM. Il ambitionne d'être une application conviviale avec une interface graphique, un installateur et des packages tout-en-un.

    620+3Évolution des étoiles sur les 7 derniers jours
  • YouDub@liuzhao1225

    YouDub est un outil open source conçu pour automatiser la traduction et le doublage de vidéos YouTube de qualité afin de les publier sur Internet. Cet outil utilise la reconnaissance vocale par IA pour transcrire l'audio en texte, traduit ensuite ce texte en chinois via un grand modèle linguistique, puis convertit le texte chinois en audio grâce au clonage vocal par IA. Il est ainsi possible de créer des vidéos doublées en chinois dotées de la voix originale du créateur.

    615-1Évolution des étoiles sur les 7 derniers jours
  • ComfyUI-VibeVoice@wildminder

    Nœud personnalisé ComfyUI pour VibeVoice TTS. Audio conversationnel expressif, long et multi-locuteur

    596-1Évolution des étoiles sur les 7 derniers jours
  • Version modifiée de Chatterbox acceptant des fichiers texte en entrée sans restriction de caractères. Je l'utilise pour créer des livres audio, en particulier pour mes enfants.

    575-1Évolution des étoiles sur les 7 derniers jours
  • Exécutez Qwen3-TTS text-to-speech localement sur Mac (M1/M2/M3/M4). Clonage de voix, design vocal, voix personnalisées. 100 % hors ligne via MLX.

    561+2Évolution des étoiles sur les 7 derniers jours
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    Le premier modèle de dialogue parlé en temps réel de bout en bout open-source au monde avec clonage de voix personnalisé.

    550+0Évolution des étoiles sur les 7 derniers jours
  • ComfyUI-OmniVoice-TTS@Saganaki22

    Nœuds OmniVoice TTS pour ComfyUI - Synthèse vocale multilingue zero-shot avec clonage de voix, conception vocale et dialogue multi-locuteurs

    545+5Évolution des étoiles sur les 7 derniers jours
  • ComfyUI-VoxCPM@wildminder

    Nœud ComfyUI pour une parole hautement expressive et un clonage vocal zero-shot réaliste

    509-1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets