Pular para o conteúdo principal
buildradar
Sign in
Tópico · voice-cloning

voice-cloning

Repositórios de código aberto acompanhados marcados com voice-cloning, ordenados por estrelas.

41 repositórios
  • vui@fluxions-ai

    Assistente de voz em tempo real — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatível com a API Realtime da OpenAI. Clonagem de voz, interrupção (barge-in), ~9× em tempo real em uma 4090. Apache 2.0.

    759+7Variação de estrelas nos últimos 7 dias
  • MimikaStudio@BoltzmannEntropy

    MimikaStudio - Um aplicativo local-first para macOS (Apple Silicon) + Suporte a MCP Agêntico

    735+4Variação de estrelas nos últimos 7 dias
  • chatterbox-tts-api@travisvn

    API de texto para fala (TTS) local e compatível com OpenAI usando o Chatterbox, permitindo que os usuários gerem fala clonada em qualquer lugar onde a API da OpenAI seja usada (ex.: Open WebUI, AnythingLLM, etc.)

    677+1Variação de estrelas nos últimos 7 dias
  • Pandrator@lukaszliniewicz

    Converta PDFs e EPUBs em audiolivros; legendas ou vídeos em vídeos dublados (incluindo tradução) e muito mais. De graça. O Pandrator usa modelos locais, incluindo clonagem de voz (instantânea, aprimorada por RVC, ajuste fino XTTS) e processamento por LLM. Ele aspira ser um aplicativo amigável com interface gráfica, instalador e pacotes tudo em um.

    620+3Variação de estrelas nos últimos 7 dias
  • YouDub@liuzhao1225

    YouDub é uma ferramenta open-source projetada para automatizar a tradução e dublagem de vídeos de alta qualidade do YouTube para publicação na internet em chinês. A ferramenta usa tecnologia de reconhecimento de fala por IA para converter áudio em texto, traduz o texto para o chinês usando modelos de linguagem de grande escala e, por fim, converte o chinês em áudio usando clonagem de voz por IA. Assim, podemos criar vídeos dublados em chinês com o timbre de voz do YouTuber original.

    615-1Variação de estrelas nos últimos 7 dias
  • ComfyUI-VibeVoice@wildminder

    Nó personalizado do ComfyUI para o VibeVoice TTS. Áudio conversacional expressivo, de formato longo e com múltiplos falantes

    596-1Variação de estrelas nos últimos 7 dias
  • Versão modificada do Chatterbox que aceita arquivos de texto como entrada e não possui restrições de caracteres. Eu o uso para criar audiolivros, especialmente para meus filhos.

    575-1Variação de estrelas nos últimos 7 dias
  • Execute o Qwen3-TTS localmente no Mac (M1/M2/M3/M4). Clonagem de voz, design de voz e vozes personalizadas. 100% offline usando MLX.

    561+2Variação de estrelas nos últimos 7 dias
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    O primeiro modelo de diálogo falado de ponta a ponta em tempo real de código aberto do mundo com clonagem de voz personalizada.

    549+0Variação de estrelas nos últimos 7 dias
  • ComfyUI-OmniVoice-TTS@Saganaki22

    Nós OmniVoice TTS para ComfyUI - Conversão de texto em fala multilíngue zero-shot com clonagem de voz, design de voz e diálogos com múltiplos falantes.

    544+5Variação de estrelas nos últimos 7 dias
  • ComfyUI-VoxCPM@wildminder

    Nó do ComfyUI para fala altamente expressiva e clonagem de voz zero-shot realista

    509-1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos