speech
Repositórios de código aberto acompanhados marcados com speech, ordenados por estrelas.
- #61
🐸 Coleção de artigos sobre TTS
★ 734+1Variação de estrelas nos últimos 7 dias - #62
Framework de reconhecimento automático de fala em PyTorch para streaming e não streaming, compatível com reconhecimento online e offline. Atualmente suporta os modelos Conformer, Squeezeformer e DeepSpeech2, além de vários métodos de aumento de dados.
★ 727+0Variação de estrelas nos últimos 7 dias - #63★ 716+0Variação de estrelas nos últimos 7 dias
- #64
Toolkit de código aberto para reconhecimento de fala ponta a ponta utilizando PyTorch-Lightning e Hydra.
★ 714+0Variação de estrelas nos últimos 7 dias - #65★ 693+1Variação de estrelas nos últimos 7 dias
- #66
API de texto para fala (TTS) local e compatível com OpenAI usando o Chatterbox, permitindo que os usuários gerem fala clonada em qualquer lugar onde a API da OpenAI seja usada (ex.: Open WebUI, AnythingLLM, etc.)
★ 677+5Variação de estrelas nos últimos 7 dias - #67
MOSS-Audio é um modelo de base de código aberto para compreensão unificada de áudio, permitindo fala, som, música, legendagem, QA e raciocínio em cenários do mundo real.
★ 656+5Variação de estrelas nos últimos 7 dias - #68
:speech_balloon: /so.nus/ STT (speech to text) para Node com detecção de palavra-chave offline
★ 638+0Variação de estrelas nos últimos 7 dias - #69
Laboratórios, empresas, recursos e estágios na área de fala/voz, recomendações e auto-recomendações são bem-vindos
★ 610+1Variação de estrelas nos últimos 7 dias - #70
Uma lista de conjuntos de dados de resposta ao impulso de sala disponíveis publicamente e scripts para baixá-los.
★ 609+2Variação de estrelas nos últimos 7 dias - #71
SpeechIO Leaderboard: uma plataforma de benchmarking ampla, robusta e abrangente para Reconhecimento Automático de Fala (ASR).
★ 553+3Variação de estrelas nos últimos 7 dias - #72
Amostras de áudio que acompanham publicações relacionadas ao Tacotron, um modelo de síntese de fala end-to-end.
★ 539+0Variação de estrelas nos últimos 7 dias - #73★ 524+1Variação de estrelas nos últimos 7 dias
- #74
StarGANv2-VC: A Diverse, Unsupervised, Non-parallel Framework for Natural-Sounding Voice Conversion
★ 522+0Variação de estrelas nos últimos 7 dias