Saltar al contenido principal
buildradar
Sign in
Tema · voice-cloning

voice-cloning

Repositorios de código abierto monitorizados etiquetados con voice-cloning, ordenados por estrellas.

41 repositorios
  • vui@fluxions-ai

    Asistente de voz en tiempo real: streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible con la API Realtime de OpenAI. Clonación de voz, interrupción (barge-in), ~9x tiempo real en una 4090. Licencia Apache 2.0.

    759+7Variación de estrellas de los últimos 7 días
  • MimikaStudio@BoltzmannEntropy

    MimikaStudio: una aplicación local-first para macOS (Apple Silicon) con soporte para agentes MCP.

    735+4Variación de estrellas de los últimos 7 días
  • chatterbox-tts-api@travisvn

    API de texto a voz (TTS) local compatible con OpenAI que utiliza Chatterbox, permitiendo a los usuarios generar voz clonada en cualquier lugar donde se utilice la API de OpenAI (por ejemplo, Open WebUI, AnythingLLM, etc.).

    677+1Variación de estrellas de los últimos 7 días
  • Pandrator@lukaszliniewicz

    Convierte PDFs y EPUBs en audiolibros; subtítulos o videos en videos doblados (incluyendo traducción) y más. Gratis. Pandrator utiliza modelos locales, incluyendo clonación de voz (instantánea, mejorada con RVC, ajuste fino con XTTS) y procesamiento LLM. Aspira a ser una aplicación fácil de usar con interfaz gráfica, instalador y paquetes todo en uno.

    620+3Variación de estrellas de los últimos 7 días
  • YouDub@liuzhao1225

    YouDub es una herramienta de código abierto diseñada para automatizar la traducción y el doblaje de videos de YouTube de alta calidad para su distribución en Internet en chino. Utiliza tecnología de reconocimiento de voz por IA para convertir audio a texto, modelos de lenguaje grandes para traducir el texto y clonación de voz por IA para generar el audio en chino, manteniendo la voz original del YouTuber.

    615-1Variación de estrellas de los últimos 7 días
  • ComfyUI-VibeVoice@wildminder

    Nodo personalizado de ComfyUI para VibeVoice TTS. Audio conversacional expresivo, de formato largo y con múltiples hablantes

    596-1Variación de estrellas de los últimos 7 días
  • Versión modificada de Chatterbox que acepta archivos de texto como entrada y no tiene restricciones de caracteres. La utilizo para crear audiolibros, especialmente para mis hijos.

    575-1Variación de estrellas de los últimos 7 días
  • Ejecuta Qwen3-TTS de texto a voz localmente en Mac (M1/M2/M3/M4). Clonación de voz, diseño de voz y voces personalizadas. 100% offline usando MLX.

    561+2Variación de estrellas de los últimos 7 días
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    El primer modelo de diálogo hablado de extremo a extremo en tiempo real de código abierto con clonación de voz personalizada.

    550+0Variación de estrellas de los últimos 7 días
  • ComfyUI-OmniVoice-TTS@Saganaki22

    Nodos OmniVoice TTS para ComfyUI: conversión de texto a voz multilingüe zero-shot con clonación de voz, diseño de voz y diálogos con múltiples hablantes

    545+5Variación de estrellas de los últimos 7 días
  • ComfyUI-VoxCPM@wildminder

    Nodo de ComfyUI para voz altamente expresiva y clonación de voz realista zero-shot.

    509-1Variación de estrellas de los últimos 7 días
← Volver a temas