Saltar al contenido principal
buildradar
Sign in
Tema · vad

vad

Repositorios de código abierto monitorizados etiquetados con vad, ordenados por estrellas.

Repositorios
13
Estrellas totales
32.319
Estrellas de media
2486
Proporción
0,00%

Temas que aparecen con frecuencia junto a vad en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con vad.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • silero-vad@snakers4

    Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado

    10.112+29Variación de estrellas de los últimos 7 días
  • ffsubsync@smacke

    Sincroniza subtítulos con video de forma mágica y automática.

    7864+7Variación de estrellas de los últimos 7 días
  • faster-whisper-GUI@CheshireCC

    Interfaz gráfica para faster_whisper con PySide6

    2995+4Variación de estrellas de los últimos 7 días
  • FluidAudio@FluidInference

    Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.

    2723+13Variación de estrellas de los últimos 7 días
  • ten-vad@TEN-framework

    Detector de actividad de voz (VAD): baja latencia, alto rendimiento y ligero

    2256+7Variación de estrellas de los últimos 7 días
  • sherpa-ncnn@k2-fsa

    Reconocimiento de voz en tiempo real y detección de actividad de voz (VAD) utilizando la nueva generación de Kaldi con ncnn sin conexión a Internet. Compatible con iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, entre otros.

    1777-1Variación de estrellas de los últimos 7 días
  • whisper.net@sandrohanea

    Whisper.net. Conversión de voz a texto simplificada mediante modelos Whisper.

    941+1Variación de estrellas de los últimos 7 días
  • auditok@amsehili

    Una herramienta de detección de actividad de voz y segmentación de audio

    860+1Variación de estrellas de los últimos 7 días
  • FireRedASR2S@FireRedTeam

    Un sistema ASR integral de grado industrial con módulos ASR, VAD, LID y Punc. FireRedASR2 admite chino (mandarín, más de 20 dialectos/acentos), inglés, cambio de código, y reconocimiento de voz y canto. FireRedVAD admite voz/canto/música en más de 100 idiomas. FireRedLID admite más de 100 idiomas y más de 20 dialectos chinos. FireRedPunc admite chino e inglés.

    670+12Variación de estrellas de los últimos 7 días
  • WhisperS2T@shashikg

    Una canalización optimizada de voz a texto para el modelo Whisper que admite múltiples motores de inferencia

    578+1Variación de estrellas de los últimos 7 días
  • ICASSP-2023-24-Papers@DmitryRyumin

    Artículos de ICASSP 2023-2024: Una colección completa de artículos de investigación influyentes y destacados de las conferencias ICASSP 2023-24. Explore los últimos avances en acústica, voz y procesamiento de señales. Código incluido. ¡Marque el repositorio con una estrella para apoyar el avance del procesamiento de audio y señales!

    526+1Variación de estrellas de los últimos 7 días
  • FireRedVAD@FireRedTeam

    Detección de actividad de voz y eventos de audio de grado industrial de última generación, compatible con más de 100 idiomas, superando a Silero-VAD, TEN-VAD, FunASR-VAD y WebRTC-VAD.

    520+5Variación de estrellas de los últimos 7 días
  • android-vad@gkonovalov

    Biblioteca de detección de actividad de voz (VAD) para Android. Soporta modelos WebRTC VAD GMM, Silero VAD DNN y Yamnet VAD DNN.

    506+1Variación de estrellas de los últimos 7 días
← Volver a temas