text-to-speech
Repositórios de código aberto acompanhados marcados com text-to-speech, ordenados por estrelas.
- #121
Pacote Text to Speech para Flutter
★ 753+0Variação de estrelas nos últimos 7 dias - #122
🔊 Kokoro Web: Conversão gratuita de texto em fala por IA, online ou auto-hospedado, compatível com OpenAI!
★ 733+2Variação de estrelas nos últimos 7 dias - #123
Rapida é uma plataforma de orquestração de IA de voz de ponta a ponta para construir agentes de voz conversacionais em tempo real com streaming de áudio, STT, TTS, VAD, integração multicanal, gerenciamento de estado de agentes e observabilidade.
★ 723+4Variação de estrelas nos últimos 7 dias - #124
Legendas de fala para texto e entrada de KB para OBS, VRChat, chat do Twitch e Discord
★ 718-1Variação de estrelas nos últimos 7 dias - #125
Implementação em Pytorch do Voicebox, a nova rede de Text-to-speech SOTA da MetaAI
★ 703+0Variação de estrelas nos últimos 7 dias - #126
Criador de vídeos totalmente automatizado usando gráficos em movimento e síntese de texto para fala para transformar boletins informativos em vídeos diários para o YouTube.
★ 703+0Variação de estrelas nos últimos 7 dias - #127
Reconhecimento de fala offline com OpenAI Whisper e TensorFlow Lite para Android
★ 689+0Variação de estrelas nos últimos 7 dias - #128
API de texto para fala (TTS) local e compatível com OpenAI usando o Chatterbox, permitindo que os usuários gerem fala clonada em qualquer lugar onde a API da OpenAI seja usada (ex.: Open WebUI, AnythingLLM, etc.)
★ 677+1Variação de estrelas nos últimos 7 dias - #129
📚 Uma extensão de dicionário personalizável que suporta consultas com dois cliques em mais de 20 idiomas, mais de 1000 dicionários, conversão de texto em fala, tradução e integração com o Anki.
★ 671+1Variação de estrelas nos últimos 7 dias - #130
LLaSA: Escalando a computação de tempo de treinamento e inferência para Síntese de Fala baseada em LLaMA
★ 658+1Variação de estrelas nos últimos 7 dias - #131
Implementação do F5-TTS em MLX
★ 644+0Variação de estrelas nos últimos 7 dias - #132★ 626+2Variação de estrelas nos últimos 7 dias
- #133
Converta PDFs e EPUBs em audiolivros; legendas ou vídeos em vídeos dublados (incluindo tradução) e muito mais. De graça. O Pandrator usa modelos locais, incluindo clonagem de voz (instantânea, aprimorada por RVC, ajuste fino XTTS) e processamento por LLM. Ele aspira ser um aplicativo amigável com interface gráfica, instalador e pacotes tudo em um.
★ 620+3Variação de estrelas nos últimos 7 dias - #134
Script Python simples para interagir com a API de TTS do TikTok
★ 611+0Variação de estrelas nos últimos 7 dias - #135
Nó personalizado do ComfyUI para o VibeVoice TTS. Áudio conversacional expressivo, de formato longo e com múltiplos falantes
★ 596-1Variação de estrelas nos últimos 7 dias - #136
Versão modificada do Chatterbox que aceita arquivos de texto como entrada e não possui restrições de caracteres. Eu o uso para criar audiolivros, especialmente para meus filhos.
★ 575-1Variação de estrelas nos últimos 7 dias - #137
O sistema de autoprogramação para seu aplicativo — Alan AI SDK para React Native
★ 575+0Variação de estrelas nos últimos 7 dias - #138
Execute o Qwen3-TTS localmente no Mac (M1/M2/M3/M4). Clonagem de voz, design de voz e vozes personalizadas. 100% offline usando MLX.
★ 561+2Variação de estrelas nos últimos 7 dias - #139
🔥🔥🔥 Uma lista selecionada de artigos sobre geração multimodal baseada em LLMs (imagem, vídeo, 3D e áudio).
★ 552+0Variação de estrelas nos últimos 7 dias - #140
Execute o Orpheus 3B localmente com o LM Studio.
★ 549+0Variação de estrelas nos últimos 7 dias - #141
Implementação não oficial do vits2-TTS em pytorch
★ 549+1Variação de estrelas nos últimos 7 dias - #142
AI Plugin é uma extensão poderosa para o Payload CMS, integrando recursos avançados de IA para aprimorar a criação e o gerenciamento de conteúdo.
★ 547-1Variação de estrelas nos últimos 7 dias - #143
Nós OmniVoice TTS para ComfyUI - Conversão de texto em fala multilíngue zero-shot com clonagem de voz, design de voz e diálogos com múltiplos falantes.
★ 545+5Variação de estrelas nos últimos 7 dias - #144
Ditado por voz ultrarrápido, gratuito, local e com transcrição no próprio dispositivo para macOS
★ 544+11Variação de estrelas nos últimos 7 dias - #145★ 525+2Variação de estrelas nos últimos 7 dias
- #146
Implementação do E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", em Pytorch
★ 517+0Variação de estrelas nos últimos 7 dias - #147
Um modelo de Text-to-Speech com clonagem de voz em vietnamita ✨
★ 516+0Variação de estrelas nos últimos 7 dias - #148
Servidor de inferência de linguagem de código aberto, local e auto-hospedado altamente otimizado com suporte a ASR/STT, TTS e LLM via WebRTC, REST e WS
★ 512+0Variação de estrelas nos últimos 7 dias - #149
Nó do ComfyUI para fala altamente expressiva e clonagem de voz zero-shot realista
★ 509-1Variação de estrelas nos últimos 7 dias - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 506+5Variação de estrelas nos últimos 7 dias