Saltar al contenido principal
buildradar
Sign in
Tema · speaker-diarization

speaker-diarization

Repositorios de código abierto monitorizados etiquetados con speaker-diarization, ordenados por estrellas.

Repositorios
20
Estrellas totales
98.208
Estrellas de media
4910
Proporción
0,01%

Temas que aparecen con frecuencia junto a speaker-diarization en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con speaker-diarization.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • FunASR@modelscope

    Kit de herramientas de reconocimiento de voz de código abierto para entrenamiento, inferencia, ASR en streaming, VAD, puntuación, canalizaciones de diarización de altavoces y servicio compatible con OpenAI/MCP.

    20.136+64Variación de estrellas de los últimos 7 días
  • speechbrain@speechbrain

    Un kit de herramientas de voz basado en PyTorch

    11.802+10Variación de estrellas de los últimos 7 días
  • WhisperLiveKit@QuentinFuxa

    Voz a texto local en tiempo real con ASR en streaming, diarización de hablantes, traducción y API compatibles con OpenAI/Deepgram.

    10.990+16Variación de estrellas de los últimos 7 días
  • pyannote-audio@pyannote

    Bloques de construcción neuronales para la diarización de hablantes: detección de actividad de voz, detección de cambio de hablante, detección de voz superpuesta y embeddings de hablantes

    10.500+16Variación de estrellas de los últimos 7 días
  • espnet@espnet

    Kit de herramientas de procesamiento de voz de extremo a extremo

    9949+3Variación de estrellas de los últimos 7 días
  • argmax-oss-swift@argmaxinc

    IA de voz en el dispositivo para Apple Silicon.

    6353+8Variación de estrellas de los últimos 7 días
  • whisper-diarization@MahmoudAshraf97

    Reconocimiento automático de voz con diarización de hablantes basado en OpenAI Whisper

    5634+1Variación de estrellas de los últimos 7 días
  • Ejecutables independientes de Whisper y Faster-Whisper para quienes no quieren lidiar con Python.

    3171+2Variación de estrellas de los últimos 7 días
  • 3D-Speaker@modelscope

    Un repositorio para verificación de locutor monomodal y multimodal, reconocimiento de locutor y diarización de locutor

    3128+3Variación de estrellas de los últimos 7 días
  • whisper-timestamped@linto-ai

    Reconocimiento automático del habla multilingüe con marcas de tiempo a nivel de palabra y puntuación de confianza

    2842+1Variación de estrellas de los últimos 7 días
  • FluidAudio@FluidInference

    Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.

    2723+13Variación de estrellas de los últimos 7 días
  • diart@juanmc2005

    Un paquete de Python para crear aplicaciones de audio en tiempo real impulsadas por IA

    2024+1Variación de estrellas de los últimos 7 días
  • Una lista curada de excelentes artículos, librerías, conjuntos de datos y otros recursos sobre Speaker Diarization.

    1894+1Variación de estrellas de los últimos 7 días
  • Fun-ASR@QwenAudio

    Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.

    1512+10Variación de estrellas de los últimos 7 días
  • wespeaker@wenet-e2e

    Kit de herramientas para la verificación, reconocimiento y diarización de hablantes orientado a la investigación y la producción.

    1402+8Variación de estrellas de los últimos 7 días
  • speech-swift@soniqo

    Kit de herramientas de voz con IA para Apple Silicon: ASR, TTS, voz a voz, VAD y diarización impulsados por MLX y CoreML

    1161+4Variación de estrellas de los últimos 7 días
  • transcriptionstream@transcriptionstream

    Servicio de transcripción y diarización offline autohospedado con resúmenes mediante LLM

    948+2Variación de estrellas de los últimos 7 días
  • MioSub@corvo007

    Software de generación de subtítulos totalmente automatizado: cubre todo el proceso de descarga, transcripción, traducción y codificación sin intervención humana.

    810+3Variación de estrellas de los últimos 7 días
  • pyannote-whisper@yinruiqing
    677+0Variación de estrellas de los últimos 7 días
  • SpectralCluster@wq2012

    Reimplementación en Python de los algoritmos de clustering espectral (restringidos) utilizados en los artículos de diarización de hablantes de Google.

    555+0Variación de estrellas de los últimos 7 días
← Volver a temas