Pular para o conteúdo principal
buildradar
Sign in
Tópico · speech-recognition

speech-recognition

Repositórios de código aberto acompanhados marcados com speech-recognition, ordenados por estrelas.

Repositórios
156
Total de estrelas
675.280
Média de estrelas
4.329
Participação
0,04%

Tópicos que aparecem com frequência ao lado de speech-recognition no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com speech-recognition.

  • qwen-audio-agent@QwenAudio

    Um runtime de voz em tempo real que mantém agentes falando, trabalhando e presentes. Runtime de voz em tempo real para agentes de IA

    2.362
  • Talkify@tornikegomareli

    Ditado por voz ultrarrápido, gratuito, local e com transcrição no próprio dispositivo para macOS

    540
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • hayamimi@oboroge0

    早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.

    327
  • transformers@huggingface

    🤗 Transformers: o framework de definição de modelos para modelos de machine learning de última geração em texto, visão, áudio e modelos multimodais, tanto para inferência quanto para treinamento.

    164.731+119Variação de estrelas nos últimos 7 dias
  • whisper.cpp@ggml-org

    Port do modelo Whisper da OpenAI em C/C++

    53.389+103Variação de estrelas nos últimos 7 dias
  • faster-whisper@SYSTRAN

    Transcrição Whisper mais rápida com CTranslate2

    25.206+71Variação de estrelas nos últimos 7 dias
  • whisperX@m-bain

    WhisperX: Reconhecimento Automático de Fala com carimbos de data/hora no nível da palavra (& Diarização).

    23.864+61Variação de estrelas nos últimos 7 dias
  • FunASR@modelscope

    Kit de ferramentas de reconhecimento de fala de código aberto para treinamento, inferência, streaming ASR, VAD, pontuação, pipelines de diarização de locutores e atendimento compatível com OpenAI/MCP.

    20.136+64Variação de estrelas nos últimos 7 dias
  • leon@leon-ai

    🧠 Leon é seu assistente pessoal de código aberto

    17.476+1Variação de estrelas nos últimos 7 dias
  • kaldi@kaldi-asr

    kaldi-asr/kaldi é o repositório oficial do projeto Kaldi.

    15.474+3Variação de estrelas nos últimos 7 dias
  • vosk-api@alphacep

    API de reconhecimento de fala offline para Android, iOS, Raspberry Pi e servidores com Python, Java, C# e Node.

    15.101+17Variação de estrelas nos últimos 7 dias
  • DeepLearningExamples@NVIDIA

    Scripts de Deep Learning de última geração organizados por modelos - fáceis de treinar e implantar com precisão e desempenho reproduzíveis em infraestrutura de nível empresarial.

    14.846+4Variação de estrelas nos últimos 7 dias
  • Mergulhe em Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision e NLP através destas aulas empolgantes!

    12.939+3Variação de estrelas nos últimos 7 dias
  • voice-pro@abus-aikorea

    Interface Web Gradio para criadores e desenvolvedores, apresentando TTS (Edge-TTS, kokoro) e clonagem de voz zero-shot (E2 & F5-TTS, CosyVoice), com processamento de áudio Whisper, download do YouTube, isolamento vocal Demucs e tradução multilíngue.

    12.730+54Variação de estrelas nos últimos 7 dias
  • PaddleSpeech@PaddlePaddle

    Kit de ferramentas de fala fácil de usar, incluindo modelo de aprendizado autossupervisionado, ASR SOTA/Streaming com pontuação, TTS de streaming com frontend de texto, sistema de verificação de locutor, tradução de fala de ponta a ponta e detecção de palavras-chave. Vencedor do prêmio NAACL2022 Best Demo.

    12.676+5Variação de estrelas nos últimos 7 dias
  • speechbrain@speechbrain

    Um kit de ferramentas de fala baseado em PyTorch

    11.802+10Variação de estrelas nos últimos 7 dias
  • WhisperLiveKit@QuentinFuxa

    Conversão de fala em texto local e em tempo real com ASR por streaming, diarização de locutor, tradução e APIs compatíveis com OpenAI/Deepgram.

    10.990+16Variação de estrelas nos últimos 7 dias
  • openvino@openvinotoolkit

    OpenVINO™ é um kit de ferramentas de código aberto para otimizar e implantar inferência de IA

    10.793+30Variação de estrelas nos últimos 7 dias
  • espnet@espnet

    Toolkit de processamento de fala de ponta a ponta

    9.949+3Variação de estrelas nos últimos 7 dias
  • SenseVoice@QwenAudio

    Modelo SenseVoiceSmall de código aberto para ASR em mandarim, cantonês, inglês, japonês e coreano, identificação de idioma, reconhecimento de emoção e detecção de eventos de áudio.

    9.209+37Variação de estrelas nos últimos 7 dias
  • Módulo de reconhecimento de fala para Python, com suporte a diversos motores e APIs, online e offline.

    8.987+0Variação de estrelas nos últimos 7 dias
  • Um sistema de reconhecimento de fala em chinês baseado em Deep Learning

    8.386+0Variação de estrelas nos últimos 7 dias
  • mlx-audio@Blaizzy

    Uma biblioteca de text-to-speech (TTS), speech-to-text (STT) e speech-to-speech (STS) construída sobre o framework MLX da Apple, oferecendo análise de fala eficiente em Apple Silicon.

    7.826+23Variação de estrelas nos últimos 7 dias
  • annyang@TalAter

    💬 Reconhecimento de fala para o seu site

    6.815-1Variação de estrelas nos últimos 7 dias
  • wav2letter@flashlight

    Toolkit de reconhecimento automático de fala do Facebook AI Research.

    6.437+1Variação de estrelas nos últimos 7 dias
  • argmax-oss-swift@argmaxinc

    IA de fala executada localmente no dispositivo para Apple Silicon

    6.353+8Variação de estrelas nos últimos 7 dias
  • PaddleX@PaddlePaddle

    Ferramenta de desenvolvimento tudo-em-um baseada em PaddlePaddle.

    6.254+3Variação de estrelas nos últimos 7 dias
  • FunClip@modelscope

    Ferramenta de transcrição de vídeo, geração de legendas e edição assistida por LLM baseada em FunASR, com interface Gradio local.

    6.210+13Variação de estrelas nos últimos 7 dias
  • whisper-diarization@MahmoudAshraf97

    Reconhecimento Automático de Fala com Diarização de Orador baseado no OpenAI Whisper

    5.634+1Variação de estrelas nos últimos 7 dias
  • wenet@wenet-e2e

    Kit de ferramentas de reconhecimento de fala de ponta a ponta, focado e pronto para produção.

    5.229+1Variação de estrelas nos últimos 7 dias
  • porcupine@Picovoice

    Detecção de wake word no dispositivo impulsionada por deep learning

    4.928+3Variação de estrelas nos últimos 7 dias
  • ml-road@yanshengjia

    Recursos, prática e pesquisa em Machine Learning e IA Agentic

    4.927+5Variação de estrelas nos últimos 7 dias
  • stt@jianchang512

    Ferramenta de reconhecimento de voz para texto / Uma ferramenta local para transcrição de áudio e vídeo que roda offline, com saída em JSON, legendas SRT e formato de texto simples

    4.780+9Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos