speech-synthesis
Repositórios de código aberto acompanhados marcados com speech-synthesis, ordenados por estrelas.
- #31
Um aplicativo ChatGPT de código aberto com voz.
★ 2.350-1Variação de estrelas nos últimos 7 dias - #32
Conversão de texto em fala rápida e controlável para mais de 7000 idiomas!
★ 2.207-1Variação de estrelas nos últimos 7 dias - #33★ 1.836+1Variação de estrelas nos últimos 7 dias
- #34
Implementação não oficial de Parallel WaveGAN (+ MelGAN, Multi-band MelGAN, HiFi-GAN e StyleMelGAN) com Pytorch.
★ 1.646+1Variação de estrelas nos últimos 7 dias - #35
Aplicativo Speech Note para Linux. Tomada de notas, leitura e tradução com conversão de fala em texto, texto em fala e tradução automática offline.
★ 1.622+8Variação de estrelas nos últimos 7 dias - #36
Nós personalizados que estendem as capacidades do Comfyui
★ 1.525+1Variação de estrelas nos últimos 7 dias - #37★ 1.498+0Variação de estrelas nos últimos 7 dias
- #38
Pré-treinamento multimodal de fala e texto para processamento de linguagem falada
★ 1.449+0Variação de estrelas nos últimos 7 dias - #39
Auto-hospede o poderoso modelo de TTS Chatterbox. Este servidor oferece uma interface web amigável, endpoints de API flexíveis (incluindo compatibilidade com OpenAI), vozes predefinidas, clonagem de voz e processamento de texto em escala de audiolivros. Executa com aceleração em NVIDIA (CUDA), AMD (ROCm) e CPU.
★ 1.427+1Variação de estrelas nos últimos 7 dias - #40
Uma lista de corpora de fala acessíveis para ASR, TTS e outras tecnologias de fala.
★ 1.399+0Variação de estrelas nos últimos 7 dias - #41
Restauração geral de fala.
★ 1.375+0Variação de estrelas nos últimos 7 dias - #42★ 1.339+0Variação de estrelas nos últimos 7 dias
- #43
StreamSpeech é um modelo "tudo em um" contínuo para reconhecimento, tradução e síntese de fala offline e simultânea.
★ 1.288+0Variação de estrelas nos últimos 7 dias - #44
Um modelo de conversão de texto em fala baseado em Flow Matching com controle de estilo via emoji
★ 1.228+4Variação de estrelas nos últimos 7 dias - #45★ 1.227+1Variação de estrelas nos últimos 7 dias
- #46
Irina - assistente de voz em russo para uso offline. Suporta habilidades via plugins.
★ 1.153+0Variação de estrelas nos últimos 7 dias - #47
AI Vtuber para streaming no YouTube/Twitch
★ 1.116+2Variação de estrelas nos últimos 7 dias - #48
AutoVC: Transferência de estilo de voz zero-shot usando apenas perda de autoencoder
★ 1.100+0Variação de estrelas nos últimos 7 dias - #49
YourTTS: Rumo a TTS multi-falante Zero-Shot e conversão de voz Zero-Shot para todos.
★ 1.054+0Variação de estrelas nos últimos 7 dias - #50
Código de exemplo da API de conversão de texto em fala da Microsoft em várias linguagens, parte dos Cognitive Services.
★ 1.014+3Variação de estrelas nos últimos 7 dias - #51
Gerador de audiolivros com múltiplas vozes impulsionado por IA — anotação de script por LLM, clonagem de voz, design de voz, treinamento LoRA, controle de estilo por linha e exportação para MP3, M4B com capítulos ou multifaixa para Audacity. Construído sobre o Qwen3-TTS.
★ 1.000+20Variação de estrelas nos últimos 7 dias - #52★ 972+3Variação de estrelas nos últimos 7 dias
- #53
Tornar as vozes TTS naturais do Azure acessíveis a qualquer aplicativo compatível com SAPI 5.
★ 934+13Variação de estrelas nos últimos 7 dias - #54
Um sistema TTS de base potencializado por LLM de código aberto
★ 919+1Variação de estrelas nos últimos 7 dias - #55
Um LLM falante que roda no seu próprio computador sem precisar de internet.
★ 891+2Variação de estrelas nos últimos 7 dias - #56
DiffWave é um vocoder neural rápido e de alta qualidade e sintetizador de formas de onda.
★ 884+0Variação de estrelas nos últimos 7 dias - #57
Confucius4-TTS: um mecanismo de TTS multilíngue e interlíngue do tipo zero-shot
★ 794+10Variação de estrelas nos últimos 7 dias - #58
Assistente de voz em tempo real — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatível com a API Realtime da OpenAI. Clonagem de voz, interrupção (barge-in), ~9× em tempo real em uma 4090. Apache 2.0.
★ 759+10Variação de estrelas nos últimos 7 dias - #59
Thorsten-Voice: Uma voz TTS em alemão de alta qualidade, gratuita e offline, disponível para qualquer projeto sem complicações de licença.
★ 729+1Variação de estrelas nos últimos 7 dias - #60
Artigos do INTERSPEECH 2023-2024: Uma coleção completa de artigos de pesquisa influentes e empolgantes da conferência INTERSPEECH 2023-24. Explore os avanços mais recentes em processamento de fala e linguagem. Código incluído. Dê uma estrela no repositório para apoiar o avanço da tecnologia de fala!
★ 684+0Variação de estrelas nos últimos 7 dias