automatic-speech-recognition
Repositórios de código aberto acompanhados marcados com automatic-speech-recognition, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de automatic-speech-recognition no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com automatic-speech-recognition.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Conversão de fala em texto local e em tempo real com ASR por streaming, diarização de locutor, tradução e APIs compatíveis com OpenAI/Deepgram.
★ 10.974+75Variação de estrelas nos últimos 7 dias - #2
Kit de ferramentas de reconhecimento de fala de ponta a ponta, focado e pronto para produção.
★ 5.228+4Variação de estrelas nos últimos 7 dias - #3
API de serviço web ASR para o OpenAI Whisper
★ 3.327+2Variação de estrelas nos últimos 7 dias - #4
[AutoArk] GPA (General Purpose Audio) pode realizar ASR, TTS e conversão de voz com um único modelo compacto!
★ 3.023+305Variação de estrelas nos últimos 7 dias - #5
Modelos de áudio CoreML de ponta em seus aplicativos — texto para fala, fala para texto, detecção de atividade de voz e diarização de locutores. Em Swift, impulsionado por código aberto SOTA.
★ 2.721+40Variação de estrelas nos últimos 7 dias - #6
🐸STT - O kit de ferramentas de aprendizado profundo para Speech-to-Text. Treinar e implantar modelos STT nunca foi tão fácil.
★ 2.605+1Variação de estrelas nos últimos 7 dias - #7★ 2.253+4Variação de estrelas nos últimos 7 dias
- #8
Modelos ASR de nível industrial de código aberto que suportam mandarim, dialetos chineses e inglês, alcançando um novo SOTA em benchmarks públicos de ASR em mandarim, oferecendo também excelente capacidade de reconhecimento de letras de músicas.
★ 1.975+9Variação de estrelas nos últimos 7 dias - #9
:zap: TensorFlowASR: Reconhecimento automático de fala quase estado da arte em Tensorflow 2. Idiomas suportados que podem usar caracteres ou subpalavras
★ 1.010+0Variação de estrelas nos últimos 7 dias - #10
Avalie seu sistema de conversão de fala em texto com medidas de similaridade como a taxa de erro de palavras (WER)
★ 926+3Variação de estrelas nos últimos 7 dias - #11
Coleção de recursos sobre as aplicações de Modelos de Linguagem Grande (LLMs) em Áudio AI.
★ 737+0Variação de estrelas nos últimos 7 dias - #12
Reconhecimento de fala offline com OpenAI Whisper e TensorFlow Lite para Android
★ 688+0Variação de estrelas nos últimos 7 dias - #13
Motor de conversão de fala em texto por streaming no dispositivo impulsionado por aprendizado profundo
★ 671+0Variação de estrelas nos últimos 7 dias - #14
Um sistema ASR All-in-One de nível industrial SOTA com módulos ASR, VAD, LID e Punc. O FireRedASR2 suporta chinês (mandarim, mais de 20 dialetos/sotaques), inglês, alternância de código, e ASR de fala e canto. O FireRedVAD suporta fala/canto/música em mais de 100 idiomas. O FireRedLID suporta mais de 100 idiomas e mais de 20 dialetos chineses. O FireRedPunc suporta chinês e inglês.
★ 664+7Variação de estrelas nos últimos 7 dias