Pular para o conteúdo principal
buildradar
Sign in
Tópico · voice-recognition

voice-recognition

Repositórios de código aberto acompanhados marcados com voice-recognition, ordenados por estrelas.

Repositórios
23
Total de estrelas
85.588
Média de estrelas
3.721
Participação
0,00%

Tópicos que aparecem com frequência ao lado de voice-recognition no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com voice-recognition.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • vosk-api@alphacep

    API de reconhecimento de fala offline para Android, iOS, Raspberry Pi e servidores com Python, Java, C# e Node.

    15.101+22Variação de estrelas nos últimos 7 dias
  • PaddleSpeech@PaddlePaddle

    Kit de ferramentas de fala fácil de usar, incluindo modelo de aprendizado autossupervisionado, ASR SOTA/Streaming com pontuação, TTS de streaming com frontend de texto, sistema de verificação de locutor, tradução de fala de ponta a ponta e detecção de palavras-chave. Vencedor do prêmio NAACL2022 Best Demo.

    12.676+6Variação de estrelas nos últimos 7 dias
  • speechbrain@speechbrain

    Um kit de ferramentas de fala baseado em PyTorch

    11.802+17Variação de estrelas nos últimos 7 dias
  • moonshine@moonshine-ai

    Conversão de fala para texto, reconhecimento de intenção e conversão de texto para fala com latência muito baixa, para a criação de agentes e interfaces de voz

    10.997+53Variação de estrelas nos últimos 7 dias
  • silero-vad@snakers4

    Silero VAD: Detector de Atividade de Voz pré-treinado de nível empresarial

    10.112+48Variação de estrelas nos últimos 7 dias
  • WhisperLive@collabora

    Uma implementação quase em tempo real do Whisper da OpenAI.

    4.246+5Variação de estrelas nos últimos 7 dias
  • cnchar@theajack

    Biblioteca utilitária abrangente para caracteres chineses (pinyin, traços, radicais, provérbios, voz, visualização, etc.).

    3.087+4Variação de estrelas nos últimos 7 dias
  • STT@coqui-ai

    🐸STT - O kit de ferramentas de aprendizado profundo para Speech-to-Text. Treinar e implantar modelos STT nunca foi tão fácil.

    2.606+0Variação de estrelas nos últimos 7 dias
  • ten-vad@TEN-framework

    Detector de Atividade de Voz (VAD): baixa latência, alto desempenho e leve

    2.256+8Variação de estrelas nos últimos 7 dias
  • voice_datasets@jim-schwoebel

    🔊 Uma lista abrangente de conjuntos de dados de código aberto para computação de voz e som (mais de 95 conjuntos de dados).

    2.223+1Variação de estrelas nos últimos 7 dias
  • Uma lista de corpora de fala acessíveis para ASR, TTS e outras tecnologias de fala.

    1.399+0Variação de estrelas nos últimos 7 dias
  • Este projeto usa uma variedade de modelos avançados de reconhecimento de impressão vocal, como EcapaTdnn, ResNetSE, ERes2Net, CAM++, etc. Não está excluído o suporte a mais modelos no futuro. Ao mesmo tempo, este projeto também suporta os métodos de pré-processamento de dados MelSpectrogram e Spectrogram

    1.313+1Variação de estrelas nos últimos 7 dias
  • Assistente de IA em Python 🧠

    1.014+0Variação de estrelas nos últimos 7 dias
  • EDDiscovery@EDDiscovery

    Registro de capitão e mapa estelar 3D para Elite Dangerous

    898+0Variação de estrelas nos últimos 7 dias
  • rhino@Picovoice

    Motor de Speech-to-Intent em dispositivo alimentado por deep learning

    711+1Variação de estrelas nos últimos 7 dias
  • voicetypr@moinulmoin

    Voicetypr - Ferramenta de ditado de voz para texto offline com IA para fundadores ocupados, vibe coders e usuários avançados de IA no macOS e Windows. Alternativa ao wispr flow e superwhisper.

    707+10Variação de estrelas nos últimos 7 dias
  • Framework de benchmark para conversão de fala em texto.

    697+0Variação de estrelas nos últimos 7 dias
  • Reconhecimento de fala para projetos React Native Expo

    676+6Variação de estrelas nos últimos 7 dias
  • cheetah@Picovoice

    Motor de conversão de fala em texto por streaming no dispositivo impulsionado por aprendizado profundo

    671+0Variação de estrelas nos últimos 7 dias
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) para Node com detecção de palavra-chave offline

    638+0Variação de estrelas nos últimos 7 dias
  • LiveTranslate@TheDeathDragon

    Tradução de áudio em tempo real: captura o áudio do sistema e microfone, executa ASR (Whisper/SenseVoice) e traduz via API de LLM com exibição em streaming. Ideal para VTubers, streamers e consumo de conteúdo em idioma estrangeiro no Windows.

    621+18Variação de estrelas nos últimos 7 dias
  • speech-to-text@reriiasu

    Transcrição em tempo real usando faster-whisper

    614+0Variação de estrelas nos últimos 7 dias
  • Uma sobreposição que obtém a permissão de voz do usuário e a entrada como texto em uma interface personalizável

    557+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos