speech-synthesis
Repositórios de código aberto acompanhados marcados com speech-synthesis, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de speech-synthesis no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com speech-synthesis.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
🐸💬 - um conjunto de ferramentas de deep learning para conversão de texto em fala (Text-to-Speech), testado em pesquisa e produção
★ 45.985+18Variação de estrelas nos últimos 7 dias - #2
VoxCPM2: TTS sem tokenizador para geração de fala multilíngue, design de voz criativo e clonagem realista
★ 36.595+345Variação de estrelas nos últimos 7 dias - #3
Um framework de IA generativa escalável criado para pesquisadores e desenvolvedores que trabalham com Grandes Modelos de Linguagem, Multimodal e IA de Voz (Reconhecimento Automático de Fala e Conversão de Texto em Fala)
★ 18.379+21Variação de estrelas nos últimos 7 dias - #4★ 17.476+1Variação de estrelas nos últimos 7 dias
- #5
Scripts de Deep Learning de última geração organizados por modelos - fáceis de treinar e implantar com precisão e desempenho reproduzíveis em infraestrutura de nível empresarial.
★ 14.846+4Variação de estrelas nos últimos 7 dias - #6
TTS multilíngue, ultrarrápido e on-device, executado nativamente via ONNX.
★ 13.757+20Variação de estrelas nos últimos 7 dias - #7
Crie agentes de voz com modelos de código aberto
★ 13.015+82Variação de estrelas nos últimos 7 dias - #8
Interface Web Gradio para criadores e desenvolvedores, apresentando TTS (Edge-TTS, kokoro) e clonagem de voz zero-shot (E2 & F5-TTS, CosyVoice), com processamento de áudio Whisper, download do YouTube, isolamento vocal Demucs e tradução multilíngue.
★ 12.730+54Variação de estrelas nos últimos 7 dias - #9
Kit de ferramentas de fala fácil de usar, incluindo modelo de aprendizado autossupervisionado, ASR SOTA/Streaming com pontuação, TTS de streaming com frontend de texto, sistema de verificação de locutor, tradução de fala de ponta a ponta e detecção de palavras-chave. Vencedor do prêmio NAACL2022 Best Demo.
★ 12.676+5Variação de estrelas nos últimos 7 dias - #10
Use o serviço de conversão de texto em fala online do Microsoft Edge a partir do Python, sem precisar do Microsoft Edge, Windows ou de uma chave de API.
★ 11.847+29Variação de estrelas nos últimos 7 dias - #11
Amphion (/æmˈfaɪən/) é um kit de ferramentas para geração de áudio, música e fala. Seu objetivo é apoiar pesquisas reprodutíveis e ajudar pesquisadores e engenheiros iniciantes a começar na área de pesquisa e desenvolvimento de geração de áudio, música e fala.
★ 10.276+1Variação de estrelas nos últimos 7 dias - #12★ 9.949+3Variação de estrelas nos últimos 7 dias
- #13
Fork do so-vits-svc com suporte em tempo real, interface aprimorada e mais recursos.
★ 9.329+3Variação de estrelas nos últimos 7 dias - #14
EmotiVoice 😊: um motor de TTS multivoz e controlado por prompt.
★ 8.522-1Variação de estrelas nos últimos 7 dias - #15
Uma biblioteca de text-to-speech (TTS), speech-to-text (STT) e speech-to-speech (STS) construída sobre o framework MLX da Apple, oferecendo análise de fala eficiente em Apple Silicon.
★ 7.826+23Variação de estrelas nos últimos 7 dias - #16
eSpeak NG é um sintetizador de voz de código aberto que suporta mais de cem idiomas e sotaques.
★ 6.802+13Variação de estrelas nos últimos 7 dias - #17
StyleTTS 2: Rumo à conversão de texto em fala de nível humano através de difusão de estilo e treinamento adversarial com grandes modelos de linguagem de fala
★ 6.342+3Variação de estrelas nos últimos 7 dias - #18
Silero Models: modelos de conversão de texto em fala pré-treinados feitos de forma extremamente simples
★ 6.084-1Variação de estrelas nos últimos 7 dias - #19★ 5.831+45Variação de estrelas nos últimos 7 dias
- #20
DiffSinger: Síntese de voz cantada via mecanismo de difusão superficial (SVS e TTS); AAAI 2022; código oficial
★ 4.855+3Variação de estrelas nos últimos 7 dias - #21
Um sistema de conversão de texto em fala de código aberto construído invertendo o Whisper.
★ 4.645+3Variação de estrelas nos últimos 7 dias - #22★ 4.258+18Variação de estrelas nos últimos 7 dias
- #23
Modelo fundamental para TTS expressivo e semelhante ao humano.
★ 4.203-1Variação de estrelas nos últimos 7 dias - #24
Converte texto em fala em tempo real.
★ 4.021+2Variação de estrelas nos últimos 7 dias - #25
:stuck_out_tongue_closed_eyes: TensorFlowTTS: Síntese de fala de última geração em tempo real para o TensorFlow 2 (suporta inglês, francês, coreano, chinês, alemão e é fácil de adaptar para outros idiomas)
★ 3.996+0Variação de estrelas nos últimos 7 dias - #26★ 2.864+0Variação de estrelas nos últimos 7 dias
- #27★ 2.818+1Variação de estrelas nos últimos 7 dias
- #28
MARY TTS: um sistema de síntese de voz multilingue de código aberto escrito em Java puro
★ 2.583+0Variação de estrelas nos últimos 7 dias - #29
TTS em vietnamita com clonagem de voz instantânea • No dispositivo • Inferência de CPU em tempo real • Qualidade de áudio de 24kHz.
★ 2.468+21Variação de estrelas nos últimos 7 dias - #30
HiFi-GAN: Redes Adversárias Generativas para síntese de fala eficiente e de alta fidelidade
★ 2.367+0Variação de estrelas nos últimos 7 dias