speaker-diarization
Repositorios de código abierto monitorizados etiquetados con speaker-diarization, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a speaker-diarization en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con speaker-diarization.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Kit de herramientas de reconocimiento de voz de código abierto para entrenamiento, inferencia, ASR en streaming, VAD, puntuación, canalizaciones de diarización de altavoces y servicio compatible con OpenAI/MCP.
★ 20.136+64Variación de estrellas de los últimos 7 días - #2
Un kit de herramientas de voz basado en PyTorch
★ 11.802+10Variación de estrellas de los últimos 7 días - #3
Voz a texto local en tiempo real con ASR en streaming, diarización de hablantes, traducción y API compatibles con OpenAI/Deepgram.
★ 10.990+16Variación de estrellas de los últimos 7 días - #4
Bloques de construcción neuronales para la diarización de hablantes: detección de actividad de voz, detección de cambio de hablante, detección de voz superpuesta y embeddings de hablantes
★ 10.500+16Variación de estrellas de los últimos 7 días - #5★ 9949+3Variación de estrellas de los últimos 7 días
- #6
IA de voz en el dispositivo para Apple Silicon.
★ 6353+8Variación de estrellas de los últimos 7 días - #7
Reconocimiento automático de voz con diarización de hablantes basado en OpenAI Whisper
★ 5634+1Variación de estrellas de los últimos 7 días - #8
Ejecutables independientes de Whisper y Faster-Whisper para quienes no quieren lidiar con Python.
★ 3171+2Variación de estrellas de los últimos 7 días - #9
Un repositorio para verificación de locutor monomodal y multimodal, reconocimiento de locutor y diarización de locutor
★ 3128+3Variación de estrellas de los últimos 7 días - #10
Reconocimiento automático del habla multilingüe con marcas de tiempo a nivel de palabra y puntuación de confianza
★ 2842+1Variación de estrellas de los últimos 7 días - #11
Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.
★ 2723+13Variación de estrellas de los últimos 7 días - #12
Un paquete de Python para crear aplicaciones de audio en tiempo real impulsadas por IA
★ 2024+1Variación de estrellas de los últimos 7 días - #13
Una lista curada de excelentes artículos, librerías, conjuntos de datos y otros recursos sobre Speaker Diarization.
★ 1894+1Variación de estrellas de los últimos 7 días - #14
Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.
★ 1512+10Variación de estrellas de los últimos 7 días - #15
Kit de herramientas para la verificación, reconocimiento y diarización de hablantes orientado a la investigación y la producción.
★ 1402+8Variación de estrellas de los últimos 7 días - #16
Kit de herramientas de voz con IA para Apple Silicon: ASR, TTS, voz a voz, VAD y diarización impulsados por MLX y CoreML
★ 1161+4Variación de estrellas de los últimos 7 días - #17
Servicio de transcripción y diarización offline autohospedado con resúmenes mediante LLM
★ 948+2Variación de estrellas de los últimos 7 días - #18
Software de generación de subtítulos totalmente automatizado: cubre todo el proceso de descarga, transcripción, traducción y codificación sin intervención humana.
★ 810+3Variación de estrellas de los últimos 7 días - #19★ 677+0Variación de estrellas de los últimos 7 días
- #20
Reimplementación en Python de los algoritmos de clustering espectral (restringidos) utilizados en los artículos de diarización de hablantes de Google.
★ 555+0Variación de estrellas de los últimos 7 días