Pular para o conteúdo principal
buildradar
Sign in
Tópico · speech-recognition

speech-recognition

Repositórios de código aberto acompanhados marcados com speech-recognition, ordenados por estrelas.

156 repositórios
  • audio-ai-hub@BinWang28

    O hub para pesquisa de IA de áudio: artigos, modelos abertos, benchmarks e datasets sobre LLMs de áudio, reconhecimento de fala, TTS, música e geração de áudio.

    953+3Variação de estrelas nos últimos 7 dias
  • transcriptionstream@transcriptionstream

    Serviço de transcrição e diarização off-line auto-hospedado pronto para uso com resumo por LLM

    948+2Variação de estrelas nos últimos 7 dias
  • whisper.net@sandrohanea

    Whisper.net. Fala para texto simplificada usando modelos Whisper

    941+1Variação de estrelas nos últimos 7 dias
  • espresso@freewym

    Espresso: Um kit de ferramentas de reconhecimento de fala neural rápido de ponta a ponta

    939+0Variação de estrelas nos últimos 7 dias
  • Um assistente de voz de desktop baseado em Python capaz de executar comandos em nível de sistema, integrando reconhecimento de fala e conversão de texto em fala, e lidando com interações de usuário assíncronas.

    919+13Variação de estrelas nos últimos 7 dias
  • TheWhisper@TheStageAI

    Modelos Whisper otimizados para streaming e uso em dispositivos

    897+0Variação de estrelas nos últimos 7 dias
  • Um LLM falante que roda no seu próprio computador sem precisar de internet.

    891+2Variação de estrelas nos últimos 7 dias
  • speechpy@astorfi

    :speech_balloon: SpeechPy - Uma biblioteca para processamento e reconhecimento de fala: http://speechpy.readthedocs.io/en/latest/

    883+0Variação de estrelas nos últimos 7 dias
  • PPASR@yeyupiaoling

    Implementação de reconhecimento de fala em chinês de ponta a ponta baseada em PaddlePaddle, do básico ao avançado, com exemplos simples e projetos corporativos práticos. Suporta os modelos DeepSpeech2, Conformer e Squeezeformer mais populares atualmente.

    870-1Variação de estrelas nos últimos 7 dias
  • react-speech-recognition@JamesBrill

    💬 Reconhecimento de fala para seu aplicativo React

    842+1Variação de estrelas nos últimos 7 dias
  • CTCDecoder@githubharald

    Algoritmos de decodificação de Connectionist Temporal Classification (CTC): melhor caminho, busca em feixe (beam search), busca em léxico, busca de prefixo e passagem de token. Implementado em Python.

    836-1Variação de estrelas nos últimos 7 dias
  • whisper-playground@saharmor

    Crie aplicações web de speech2text em tempo real usando o Whisper da OpenAI https://openai.com/blog/whisper/

    835+0Variação de estrelas nos últimos 7 dias
  • kur@deepgram

    Deep Learning Descritivo

    823-1Variação de estrelas nos últimos 7 dias
  • vocalinux@VocaHQ

    Ditado de voz gratuito, de código aberto e 100% offline para Linux. Fale e digite em qualquer lugar via motores whisper.cpp, Whisper e VOSK, acelerado por GPU, funciona em X11 + Wayland!

    806+21Variação de estrelas nos últimos 7 dias
  • lobe-tts@lobehub

    🎤 Lobe TTS - Uma biblioteca TTS/STT confiável e de alta qualidade para servidor e navegador.

    805+1Variação de estrelas nos últimos 7 dias
  • Fala para Texto para Fala. Música tocando agora. Envia texto como mensagens OSC para o VRChat para exibir no avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4Variação de estrelas nos últimos 7 dias
  • whisper.rn@mybigday

    Binding para React Native do whisper.cpp.

    800-1Variação de estrelas nos últimos 7 dias
  • june@mezbaul-h

    Chatbot de voz local para conversas envolventes, utilizando Ollama, Hugging Face Transformers e Coqui TTS Toolkit.

    788+1Variação de estrelas nos últimos 7 dias
  • whisper_mic@mallorbc

    Projeto que permite usar um microfone com o OpenAI Whisper.

    787+0Variação de estrelas nos últimos 7 dias
  • GigaAM@salute-developers

    Modelo fundamental para tarefas de reconhecimento de fala

    786+17Variação de estrelas nos últimos 7 dias
  • SwiftWhisper@exPHAT

    🎤 A maneira mais fácil de transcrever áudio em Swift

    785-1Variação de estrelas nos últimos 7 dias
  • NotelyVoice@Notely-Voice

    Um aplicativo de transcrição de voz por IA 100% privado que converte fala em texto em mais de 100 idiomas. Construído com Compose Multiplatform para Android e iOS usando Whisper AI - sem uploads para a nuvem, todo o processamento ocorre no dispositivo para total privacidade.

    777+1Variação de estrelas nos últimos 7 dias
  • cn2an@Ailln

    Conversão rápida entre números chineses e algarismos arábicos (recursos mais recentes: frações, datas, temperaturas, etc.).

    766+0Variação de estrelas nos últimos 7 dias
  • dla@markovka17

    Deep learning para processamento de áudio

    763+1Variação de estrelas nos últimos 7 dias
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    Reconhecimento de fala em chinês implementado com base no PaddlePaddle. Projeto completo com excelentes resultados de reconhecimento. Suporta treinamento e predição em Windows e Linux, além de predição na placa Nvidia Jetson.

    762+0Variação de estrelas nos últimos 7 dias
  • chaplin@amanvirparhar

    Uma ferramenta de reconhecimento de fala silenciosa em tempo real.

    754+2Variação de estrelas nos últimos 7 dias
  • Executando o modelo de fala para texto (whisper.cpp) no Unity3d em sua máquina local.

    751+1Variação de estrelas nos últimos 7 dias
  • allosaurus@xinjli

    Allosaurus é um reconhecedor universal de fonemas pré-treinado para mais de 2000 idiomas

    746+4Variação de estrelas nos últimos 7 dias
  • Transcribro@soupslurpr

    Teclado e serviço de reconhecimento de fala privado e executado no dispositivo para Android.

    745+6Variação de estrelas nos últimos 7 dias
  • MASR@yeyupiaoling

    Framework de reconhecimento automático de fala em PyTorch para streaming e não streaming, compatível com reconhecimento online e offline. Atualmente suporta os modelos Conformer, Squeezeformer e DeepSpeech2, além de vários métodos de aumento de dados.

    727+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos