voice-cloning
Repositórios de código aberto acompanhados marcados com voice-cloning, ordenados por estrelas.
- #31
Assistente de voz em tempo real — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatível com a API Realtime da OpenAI. Clonagem de voz, interrupção (barge-in), ~9× em tempo real em uma 4090. Apache 2.0.
★ 759+7Variação de estrelas nos últimos 7 dias - #32
MimikaStudio - Um aplicativo local-first para macOS (Apple Silicon) + Suporte a MCP Agêntico
★ 735+4Variação de estrelas nos últimos 7 dias - #33
API de texto para fala (TTS) local e compatível com OpenAI usando o Chatterbox, permitindo que os usuários gerem fala clonada em qualquer lugar onde a API da OpenAI seja usada (ex.: Open WebUI, AnythingLLM, etc.)
★ 677+1Variação de estrelas nos últimos 7 dias - #34
Converta PDFs e EPUBs em audiolivros; legendas ou vídeos em vídeos dublados (incluindo tradução) e muito mais. De graça. O Pandrator usa modelos locais, incluindo clonagem de voz (instantânea, aprimorada por RVC, ajuste fino XTTS) e processamento por LLM. Ele aspira ser um aplicativo amigável com interface gráfica, instalador e pacotes tudo em um.
★ 620+3Variação de estrelas nos últimos 7 dias - #35
YouDub é uma ferramenta open-source projetada para automatizar a tradução e dublagem de vídeos de alta qualidade do YouTube para publicação na internet em chinês. A ferramenta usa tecnologia de reconhecimento de fala por IA para converter áudio em texto, traduz o texto para o chinês usando modelos de linguagem de grande escala e, por fim, converte o chinês em áudio usando clonagem de voz por IA. Assim, podemos criar vídeos dublados em chinês com o timbre de voz do YouTuber original.
★ 615-1Variação de estrelas nos últimos 7 dias - #36
Nó personalizado do ComfyUI para o VibeVoice TTS. Áudio conversacional expressivo, de formato longo e com múltiplos falantes
★ 596-1Variação de estrelas nos últimos 7 dias - #37
Versão modificada do Chatterbox que aceita arquivos de texto como entrada e não possui restrições de caracteres. Eu o uso para criar audiolivros, especialmente para meus filhos.
★ 575-1Variação de estrelas nos últimos 7 dias - #38
Execute o Qwen3-TTS localmente no Mac (M1/M2/M3/M4). Clonagem de voz, design de voz e vozes personalizadas. 100% offline usando MLX.
★ 561+2Variação de estrelas nos últimos 7 dias - #39
O primeiro modelo de diálogo falado de ponta a ponta em tempo real de código aberto do mundo com clonagem de voz personalizada.
★ 549+0Variação de estrelas nos últimos 7 dias - #40
Nós OmniVoice TTS para ComfyUI - Conversão de texto em fala multilíngue zero-shot com clonagem de voz, design de voz e diálogos com múltiplos falantes.
★ 544+5Variação de estrelas nos últimos 7 dias - #41
Nó do ComfyUI para fala altamente expressiva e clonagem de voz zero-shot realista
★ 509-1Variação de estrelas nos últimos 7 dias