speech-processing
Repositórios de código aberto acompanhados marcados com speech-processing, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de speech-processing no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com speech-processing.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Um kit de ferramentas de fala baseado em PyTorch
★ 11.792+22Variação de estrelas nos últimos 7 dias - #2
Blocos de construção neural para diarização de locutores: detecção de atividade de fala, detecção de mudança de locutor, detecção de fala sobreposta, embutimento de locutor
★ 10.484+38Variação de estrelas nos últimos 7 dias - #3
Silero VAD: Detector de Atividade de Voz pré-treinado de nível empresarial
★ 10.083+52Variação de estrelas nos últimos 7 dias - #4
Torne-se um pesquisador ou engenheiro de IA/ML de alto nível com este livro didático não convencional que cobre matemática, computação e ML com intuição.
★ 7.379+33Variação de estrelas nos últimos 7 dias - #5
Lista de leitura para tópicos de pesquisa em aprendizado de máquina multimodal
★ 6.925+0Variação de estrelas nos últimos 7 dias - #6
Arquitetura de base para (M)LLMs
★ 3.138+1Variação de estrelas nos últimos 7 dias - #7
Reconhecimento automático de fala multilíngue com carimbos de data/hora em nível de palavra e confiança
★ 2.841+2Variação de estrelas nos últimos 7 dias - #8
Redução de ruído e aprimoramento de fala com tecnologia de IA
★ 2.401+6Variação de estrelas nos últimos 7 dias - #9★ 2.250+4Variação de estrelas nos últimos 7 dias
- #10
Conversão de texto em fala rápida e controlável para mais de 7000 idiomas!
★ 2.208+0Variação de estrelas nos últimos 7 dias - #11
Uma lista selecionada de artigos, bibliotecas, conjuntos de dados e outros recursos incríveis sobre Diarização de Locutores.
★ 1.893+2Variação de estrelas nos últimos 7 dias - #12
Uma lista de corpora de fala acessíveis para ASR, TTS e outras tecnologias de fala.
★ 1.399+0Variação de estrelas nos últimos 7 dias - #13
Restauração geral de fala.
★ 1.376+3Variação de estrelas nos últimos 7 dias - #14
Transcrição controlável. Verbatim (cada palavra, preenchimento, pausa, gagueira, som vocal) ou pretendida (o que o falante quis dizer, otimizado para legibilidade) com carimbos de data/hora em nível de palavra.
★ 1.362+21Variação de estrelas nos últimos 7 dias - #15
StreamSpeech é um modelo "tudo em um" contínuo para reconhecimento, tradução e síntese de fala offline e simultânea.
★ 1.288+2Variação de estrelas nos últimos 7 dias - #16★ 1.146+0Variação de estrelas nos últimos 7 dias
- #17
Um framework para processamento de fala, linguagem, áudio e música com Large Language Model
★ 1.056+0Variação de estrelas nos últimos 7 dias - #18
Você pode encontrar os algoritmos de fala desejados aqui.
★ 879+1Variação de estrelas nos últimos 7 dias - #19
[NeurIPS 2021] Benchmarks em Multiuso para Aprendizado de Representação Multimodal
★ 636+0Variação de estrelas nos últimos 7 dias - #20
Laboratórios, empresas, recursos e estágios na área de fala/voz, recomendações e auto-recomendações são bem-vindos
★ 609+0Variação de estrelas nos últimos 7 dias