vad
Repositórios de código aberto acompanhados marcados com vad, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de vad no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com vad.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Silero VAD: Detector de Atividade de Voz pré-treinado de nível empresarial
★ 10.112+48Variação de estrelas nos últimos 7 dias - #2★ 7.864+10Variação de estrelas nos últimos 7 dias
- #3
Interface gráfica para faster_whisper com PySide6
★ 2.995+4Variação de estrelas nos últimos 7 dias - #4
Modelos de áudio CoreML de ponta em seus aplicativos — texto para fala, fala para texto, detecção de atividade de voz e diarização de locutores. Em Swift, impulsionado por código aberto SOTA.
★ 2.723+22Variação de estrelas nos últimos 7 dias - #5★ 2.256+8Variação de estrelas nos últimos 7 dias
- #6
Reconhecimento de fala em tempo real e detecção de atividade de voz (VAD) usando a nova geração do Kaldi com ncnn, sem necessidade de conexão com a Internet. Suporte para iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, entre outros.
★ 1.777-2Variação de estrelas nos últimos 7 dias - #7
Whisper.net. Fala para texto simplificada usando modelos Whisper
★ 941+2Variação de estrelas nos últimos 7 dias - #8★ 860+1Variação de estrelas nos últimos 7 dias
- #9
Um sistema ASR All-in-One de nível industrial SOTA com módulos ASR, VAD, LID e Punc. O FireRedASR2 suporta chinês (mandarim, mais de 20 dialetos/sotaques), inglês, alternância de código, e ASR de fala e canto. O FireRedVAD suporta fala/canto/música em mais de 100 idiomas. O FireRedLID suporta mais de 100 idiomas e mais de 20 dialetos chineses. O FireRedPunc suporta chinês e inglês.
★ 669+10Variação de estrelas nos últimos 7 dias - #10
Um pipeline otimizado de Speech-to-Text para o modelo Whisper, suportando múltiplos motores de inferência
★ 578+1Variação de estrelas nos últimos 7 dias - #11
Artigos do ICASSP 2023-2024: Uma coleção completa de artigos de pesquisa influentes e empolgantes das conferências ICASSP 2023-24. Explore os avanços mais recentes em acústica, fala e processamento de sinais. Código incluído. Dê uma estrela no repositório para apoiar o avanço do processamento de áudio e sinais!
★ 526+0Variação de estrelas nos últimos 7 dias - #12
Detecção de atividade de voz e eventos de áudio de nível industrial SOTA, suportando mais de 100 idiomas, superando Silero-VAD, TEN-VAD, FunASR-VAD e WebRTC-VAD
★ 519+8Variação de estrelas nos últimos 7 dias - #13
Biblioteca de Detecção de Atividade de Voz (VAD) para Android. Suporta modelos WebRTC VAD GMM, Silero VAD DNN e Yamnet VAD DNN.
★ 506+1Variação de estrelas nos últimos 7 dias