vad
Repositorios de código abierto monitorizados etiquetados con vad, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a vad en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con vad.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado
★ 10.112+29Variación de estrellas de los últimos 7 días - #2★ 7864+7Variación de estrellas de los últimos 7 días
- #3
Interfaz gráfica para faster_whisper con PySide6
★ 2995+4Variación de estrellas de los últimos 7 días - #4
Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.
★ 2723+13Variación de estrellas de los últimos 7 días - #5★ 2256+7Variación de estrellas de los últimos 7 días
- #6
Reconocimiento de voz en tiempo real y detección de actividad de voz (VAD) utilizando la nueva generación de Kaldi con ncnn sin conexión a Internet. Compatible con iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, entre otros.
★ 1777-1Variación de estrellas de los últimos 7 días - #7
Whisper.net. Conversión de voz a texto simplificada mediante modelos Whisper.
★ 941+1Variación de estrellas de los últimos 7 días - #8★ 860+1Variación de estrellas de los últimos 7 días
- #9
Un sistema ASR integral de grado industrial con módulos ASR, VAD, LID y Punc. FireRedASR2 admite chino (mandarín, más de 20 dialectos/acentos), inglés, cambio de código, y reconocimiento de voz y canto. FireRedVAD admite voz/canto/música en más de 100 idiomas. FireRedLID admite más de 100 idiomas y más de 20 dialectos chinos. FireRedPunc admite chino e inglés.
★ 670+12Variación de estrellas de los últimos 7 días - #10
Una canalización optimizada de voz a texto para el modelo Whisper que admite múltiples motores de inferencia
★ 578+1Variación de estrellas de los últimos 7 días - #11
Artículos de ICASSP 2023-2024: Una colección completa de artículos de investigación influyentes y destacados de las conferencias ICASSP 2023-24. Explore los últimos avances en acústica, voz y procesamiento de señales. Código incluido. ¡Marque el repositorio con una estrella para apoyar el avance del procesamiento de audio y señales!
★ 526+1Variación de estrellas de los últimos 7 días - #12
Detección de actividad de voz y eventos de audio de grado industrial de última generación, compatible con más de 100 idiomas, superando a Silero-VAD, TEN-VAD, FunASR-VAD y WebRTC-VAD.
★ 520+5Variación de estrellas de los últimos 7 días - #13
Biblioteca de detección de actividad de voz (VAD) para Android. Soporta modelos WebRTC VAD GMM, Silero VAD DNN y Yamnet VAD DNN.
★ 506+1Variación de estrellas de los últimos 7 días