Saltar al contenido principal
buildradar
Sign in
Tema · speech-processing

speech-processing

Repositorios de código abierto monitorizados etiquetados con speech-processing, ordenados por estrellas.

Repositorios
20
Estrellas totales
71.137
Estrellas de media
3557
Proporción
0,00%

Temas que aparecen con frecuencia junto a speech-processing en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con speech-processing.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • speechbrain@speechbrain

    Un kit de herramientas de voz basado en PyTorch

    11.792+22Variación de estrellas de los últimos 7 días
  • pyannote-audio@pyannote

    Bloques de construcción neuronales para la diarización de hablantes: detección de actividad de voz, detección de cambio de hablante, detección de voz superpuesta y embeddings de hablantes

    10.484+38Variación de estrellas de los últimos 7 días
  • silero-vad@snakers4

    Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado

    10.083+52Variación de estrellas de los últimos 7 días
  • maths-cs-ai-compendium@HenryNdubuaku

    Conviértete en un investigador/ingeniero experto en IA/ML con este libro de texto no convencional que abarca matemáticas, computación y ML con intuición.

    7379+33Variación de estrellas de los últimos 7 días
  • Lista de lectura para temas de investigación en aprendizaje automático multimodal

    6925+0Variación de estrellas de los últimos 7 días
  • torchscale@microsoft

    Arquitectura base para (M)LLMs

    3138+1Variación de estrellas de los últimos 7 días
  • whisper-timestamped@linto-ai

    Reconocimiento automático del habla multilingüe con marcas de tiempo a nivel de palabra y puntuación de confianza

    2841+2Variación de estrellas de los últimos 7 días
  • resemble-enhance@resemble-ai

    Eliminación de ruido y mejora de voz impulsada por IA

    2401+6Variación de estrellas de los últimos 7 días
  • ten-vad@TEN-framework

    Detector de actividad de voz (VAD): baja latencia, alto rendimiento y ligero

    2250+4Variación de estrellas de los últimos 7 días
  • IMS-Toucan@DigitalPhonetics

    ¡Texto a voz controlable y rápido para más de 7000 idiomas!

    2208+0Variación de estrellas de los últimos 7 días
  • Una lista curada de excelentes artículos, librerías, conjuntos de datos y otros recursos sobre Speaker Diarization.

    1893+2Variación de estrellas de los últimos 7 días
  • Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.

    1399+0Variación de estrellas de los últimos 7 días
  • voicefixer@haoheliu

    Restauración general de voz.

    1376+3Variación de estrellas de los últimos 7 días
  • CrisperWhisper@nyrahealth

    Transcripción controlable. Literal (incluyendo muletillas, pausas, tartamudeos, sonidos vocales) o intencionada (lo que el hablante quiso decir, optimizado para legibilidad) con marcas de tiempo a nivel de palabra.

    1362+21Variación de estrellas de los últimos 7 días
  • StreamSpeech@ictnlp

    StreamSpeech es un modelo integrado "Todo en uno" para el reconocimiento, traducción y síntesis de voz tanto fuera de línea como simultáneos.

    1288+2Variación de estrellas de los últimos 7 días
  • audino@midas-research

    Herramienta de código abierto para la anotación de audio

    1146+0Variación de estrellas de los últimos 7 días
  • SLAM-LLM@X-LANCE

    Un framework para procesamiento de voz, lenguaje, audio y música con modelos de lenguaje grandes

    1056+0Variación de estrellas de los últimos 7 días
  • Aquí puedes encontrar los algoritmos de voz que buscas.

    878+1Variación de estrellas de los últimos 7 días
  • MultiBench@pliang279

    [NeurIPS 2021] Benchmarks multiescala para el aprendizaje de representación multimodal

    636+0Variación de estrellas de los últimos 7 días
  • Laboratorios, empresas, recursos y pasantías en el área de voz; se aceptan recomendaciones o autocandidaturas.

    609+0Variación de estrellas de los últimos 7 días
← Volver a temas