Saltar al contenido principal
buildradar
Sign in
Tema · voice-activity-detection

voice-activity-detection

Repositorios de código abierto monitorizados etiquetados con voice-activity-detection, ordenados por estrellas.

Repositorios
23
Estrellas totales
83.655
Estrellas de media
3637
Proporción
0,00%

Temas que aparecen con frecuencia junto a voice-activity-detection en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con voice-activity-detection.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • FunASR@modelscope

    Kit de herramientas de reconocimiento de voz de código abierto para entrenamiento, inferencia, ASR en streaming, VAD, puntuación, canalizaciones de diarización de altavoces y servicio compatible con OpenAI/MCP.

    20.136+64Variación de estrellas de los últimos 7 días
  • pyannote-audio@pyannote

    Bloques de construcción neuronales para la diarización de hablantes: detección de actividad de voz, detección de cambio de hablante, detección de voz superpuesta y embeddings de hablantes

    10.500+16Variación de estrellas de los últimos 7 días
  • NoiseTorch@noisetorch

    Supresión de ruido de micrófono en tiempo real en Linux.

    10.315+2Variación de estrellas de los últimos 7 días
  • silero-vad@snakers4

    Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado

    10.112+29Variación de estrellas de los últimos 7 días
  • ffsubsync@smacke

    Sincroniza subtítulos con video de forma mágica y automática.

    7864+7Variación de estrellas de los últimos 7 días
  • FluidAudio@FluidInference

    Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.

    2723+13Variación de estrellas de los últimos 7 días
  • pluely@iamsrikanthnani

    La alternativa de código abierto a Cluely: un asistente de IA ultrarrápido y centrado en la privacidad que funciona sin problemas durante reuniones, entrevistas y conversaciones sin que nadie lo note. Construido con Tauri para un rendimiento nativo, de solo 10 MB. Completamente sigiloso en videollamadas, pantallas compartidas y grabaciones.

    2619+12Variación de estrellas de los últimos 7 días
  • ten-vad@TEN-framework

    Detector de actividad de voz (VAD): baja latencia, alto rendimiento y ligero

    2256+7Variación de estrellas de los últimos 7 días
  • voice_datasets@jim-schwoebel

    🔊 Una lista completa de conjuntos de datos de código abierto para voz y computación de sonido (más de 95 conjuntos de datos).

    2223+1Variación de estrellas de los últimos 7 días
  • vad@ricky0123

    Detector de actividad de voz (VAD) para el navegador con una API sencilla

    2046+1Variación de estrellas de los últimos 7 días
  • diart@juanmc2005

    Un paquete de Python para crear aplicaciones de audio en tiempo real impulsadas por IA

    2024+1Variación de estrellas de los últimos 7 días
  • sherpa-ncnn@k2-fsa

    Reconocimiento de voz en tiempo real y detección de actividad de voz (VAD) utilizando la nueva generación de Kaldi con ncnn sin conexión a Internet. Compatible con iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, entre otros.

    1777-1Variación de estrellas de los últimos 7 días
  • Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.

    1399+0Variación de estrellas de los últimos 7 días
  • speech-swift@soniqo

    Kit de herramientas de voz con IA para Apple Silicon: ASR, TTS, voz a voz, VAD y diarización impulsados por MLX y CoreML

    1161+4Variación de estrellas de los últimos 7 días
  • Asistente de IA en Python 🧠

    1014+0Variación de estrellas de los últimos 7 días
  • whisper.net@sandrohanea

    Whisper.net. Conversión de voz a texto simplificada mediante modelos Whisper.

    941+1Variación de estrellas de los últimos 7 días
  • inaSpeechSegmenter@ina-foss

    Kit de herramientas de segmentación de audio basado en CNN. Permite detectar voz, música, ruido y el género del hablante. Diseñado para estudios de igualdad de género a gran escala basados en el tiempo de habla por género.

    910+1Variación de estrellas de los últimos 7 días
  • auditok@amsehili

    Una herramienta de detección de actividad de voz y segmentación de audio

    860+1Variación de estrellas de los últimos 7 días
  • FireRedASR2S@FireRedTeam

    Un sistema ASR integral de grado industrial con módulos ASR, VAD, LID y Punc. FireRedASR2 admite chino (mandarín, más de 20 dialectos/acentos), inglés, cambio de código, y reconocimiento de voz y canto. FireRedVAD admite voz/canto/música en más de 100 idiomas. FireRedLID admite más de 100 idiomas y más de 20 dialectos chinos. FireRedPunc admite chino e inglés.

    670+12Variación de estrellas de los últimos 7 días
  • WhisperS2T@shashikg

    Una canalización optimizada de voz a texto para el modelo Whisper que admite múltiples motores de inferencia

    578+1Variación de estrellas de los últimos 7 días
  • FireRedVAD@FireRedTeam

    Detección de actividad de voz y eventos de audio de grado industrial de última generación, compatible con más de 100 idiomas, superando a Silero-VAD, TEN-VAD, FunASR-VAD y WebRTC-VAD.

    520+5Variación de estrellas de los últimos 7 días
  • subaligner@baxtree

    Sincroniza y traduce subtítulos automáticamente, o crea nuevos mediante transcripción, utilizando DNN preentrenadas, alineaciones forzadas y Transformers. https://subaligner.readthedocs.io/

    509+0Variación de estrellas de los últimos 7 días
  • android-vad@gkonovalov

    Biblioteca de detección de actividad de voz (VAD) para Android. Soporta modelos WebRTC VAD GMM, Silero VAD DNN y Yamnet VAD DNN.

    506+1Variación de estrellas de los últimos 7 días
← Volver a temas