speech-processing
Repositorios de código abierto monitorizados etiquetados con speech-processing, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a speech-processing en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con speech-processing.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Un kit de herramientas de voz basado en PyTorch
★ 11.792+22Variación de estrellas de los últimos 7 días - #2
Bloques de construcción neuronales para la diarización de hablantes: detección de actividad de voz, detección de cambio de hablante, detección de voz superpuesta y embeddings de hablantes
★ 10.484+38Variación de estrellas de los últimos 7 días - #3
Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado
★ 10.083+52Variación de estrellas de los últimos 7 días - #4
Conviértete en un investigador/ingeniero experto en IA/ML con este libro de texto no convencional que abarca matemáticas, computación y ML con intuición.
★ 7379+33Variación de estrellas de los últimos 7 días - #5
Lista de lectura para temas de investigación en aprendizaje automático multimodal
★ 6925+0Variación de estrellas de los últimos 7 días - #6
Arquitectura base para (M)LLMs
★ 3138+1Variación de estrellas de los últimos 7 días - #7
Reconocimiento automático del habla multilingüe con marcas de tiempo a nivel de palabra y puntuación de confianza
★ 2841+2Variación de estrellas de los últimos 7 días - #8
Eliminación de ruido y mejora de voz impulsada por IA
★ 2401+6Variación de estrellas de los últimos 7 días - #9★ 2250+4Variación de estrellas de los últimos 7 días
- #10
¡Texto a voz controlable y rápido para más de 7000 idiomas!
★ 2208+0Variación de estrellas de los últimos 7 días - #11
Una lista curada de excelentes artículos, librerías, conjuntos de datos y otros recursos sobre Speaker Diarization.
★ 1893+2Variación de estrellas de los últimos 7 días - #12
Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.
★ 1399+0Variación de estrellas de los últimos 7 días - #13
Restauración general de voz.
★ 1376+3Variación de estrellas de los últimos 7 días - #14
Transcripción controlable. Literal (incluyendo muletillas, pausas, tartamudeos, sonidos vocales) o intencionada (lo que el hablante quiso decir, optimizado para legibilidad) con marcas de tiempo a nivel de palabra.
★ 1362+21Variación de estrellas de los últimos 7 días - #15
StreamSpeech es un modelo integrado "Todo en uno" para el reconocimiento, traducción y síntesis de voz tanto fuera de línea como simultáneos.
★ 1288+2Variación de estrellas de los últimos 7 días - #16★ 1146+0Variación de estrellas de los últimos 7 días
- #17
Un framework para procesamiento de voz, lenguaje, audio y música con modelos de lenguaje grandes
★ 1056+0Variación de estrellas de los últimos 7 días - #18
Aquí puedes encontrar los algoritmos de voz que buscas.
★ 878+1Variación de estrellas de los últimos 7 días - #19
[NeurIPS 2021] Benchmarks multiescala para el aprendizaje de representación multimodal
★ 636+0Variación de estrellas de los últimos 7 días - #20
Laboratorios, empresas, recursos y pasantías en el área de voz; se aceptan recomendaciones o autocandidaturas.
★ 609+0Variación de estrellas de los últimos 7 días