Pular para o conteúdo principal
buildradar
Sign in
Tópico · vad

vad

Repositórios de código aberto acompanhados marcados com vad, ordenados por estrelas.

Repositórios
13
Total de estrelas
32.319
Média de estrelas
2.486
Participação
0,00%

Tópicos que aparecem com frequência ao lado de vad no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com vad.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • silero-vad@snakers4

    Silero VAD: Detector de Atividade de Voz pré-treinado de nível empresarial

    10.112+48Variação de estrelas nos últimos 7 dias
  • ffsubsync@smacke

    Sincronize legendas com vídeos automaticamente.

    7.864+10Variação de estrelas nos últimos 7 dias
  • faster-whisper-GUI@CheshireCC

    Interface gráfica para faster_whisper com PySide6

    2.995+4Variação de estrelas nos últimos 7 dias
  • FluidAudio@FluidInference

    Modelos de áudio CoreML de ponta em seus aplicativos — texto para fala, fala para texto, detecção de atividade de voz e diarização de locutores. Em Swift, impulsionado por código aberto SOTA.

    2.723+22Variação de estrelas nos últimos 7 dias
  • ten-vad@TEN-framework

    Detector de Atividade de Voz (VAD): baixa latência, alto desempenho e leve

    2.256+8Variação de estrelas nos últimos 7 dias
  • sherpa-ncnn@k2-fsa

    Reconhecimento de fala em tempo real e detecção de atividade de voz (VAD) usando a nova geração do Kaldi com ncnn, sem necessidade de conexão com a Internet. Suporte para iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, entre outros.

    1.777-2Variação de estrelas nos últimos 7 dias
  • whisper.net@sandrohanea

    Whisper.net. Fala para texto simplificada usando modelos Whisper

    941+2Variação de estrelas nos últimos 7 dias
  • auditok@amsehili

    Uma ferramenta de detecção de atividade de voz e segmentação de áudio

    860+1Variação de estrelas nos últimos 7 dias
  • FireRedASR2S@FireRedTeam

    Um sistema ASR All-in-One de nível industrial SOTA com módulos ASR, VAD, LID e Punc. O FireRedASR2 suporta chinês (mandarim, mais de 20 dialetos/sotaques), inglês, alternância de código, e ASR de fala e canto. O FireRedVAD suporta fala/canto/música em mais de 100 idiomas. O FireRedLID suporta mais de 100 idiomas e mais de 20 dialetos chineses. O FireRedPunc suporta chinês e inglês.

    669+10Variação de estrelas nos últimos 7 dias
  • WhisperS2T@shashikg

    Um pipeline otimizado de Speech-to-Text para o modelo Whisper, suportando múltiplos motores de inferência

    578+1Variação de estrelas nos últimos 7 dias
  • ICASSP-2023-24-Papers@DmitryRyumin

    Artigos do ICASSP 2023-2024: Uma coleção completa de artigos de pesquisa influentes e empolgantes das conferências ICASSP 2023-24. Explore os avanços mais recentes em acústica, fala e processamento de sinais. Código incluído. Dê uma estrela no repositório para apoiar o avanço do processamento de áudio e sinais!

    526+0Variação de estrelas nos últimos 7 dias
  • FireRedVAD@FireRedTeam

    Detecção de atividade de voz e eventos de áudio de nível industrial SOTA, suportando mais de 100 idiomas, superando Silero-VAD, TEN-VAD, FunASR-VAD e WebRTC-VAD

    519+8Variação de estrelas nos últimos 7 dias
  • android-vad@gkonovalov

    Biblioteca de Detecção de Atividade de Voz (VAD) para Android. Suporta modelos WebRTC VAD GMM, Silero VAD DNN e Yamnet VAD DNN.

    506+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos