automatic-speech-recognition
Repositorios de código abierto monitorizados etiquetados con automatic-speech-recognition, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a automatic-speech-recognition en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con automatic-speech-recognition.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Voz a texto local en tiempo real con ASR en streaming, diarización de hablantes, traducción y API compatibles con OpenAI/Deepgram.
★ 10.974+75Variación de estrellas de los últimos 7 días - #2
Kit de herramientas de reconocimiento de voz de extremo a extremo listo para producción y centrado en la producción
★ 5228+4Variación de estrellas de los últimos 7 días - #3
API de servicio web para OpenAI Whisper ASR
★ 3326+2Variación de estrellas de los últimos 7 días - #4
[AutoArk] ¡GPA (Audio de Propósito General) puede hacer reconocimiento de voz (ASR), síntesis de voz (TTS) y conversión de voz con un modelo diminuto!
★ 2897+305Variación de estrellas de los últimos 7 días - #5
Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.
★ 2710+40Variación de estrellas de los últimos 7 días - #6
🐸STT - El kit de herramientas de aprendizaje profundo para conversión de voz a texto (Speech-to-Text). Entrenar y desplegar modelos STT nunca ha sido tan fácil.
★ 2605+1Variación de estrellas de los últimos 7 días - #7★ 2253+4Variación de estrellas de los últimos 7 días
- #8
Modelos ASR de grado industrial de código abierto que admiten mandarín, dialectos chinos e inglés, logrando un nuevo SOTA en benchmarks públicos de ASR en mandarín, y ofreciendo además una capacidad excepcional de reconocimiento de letras de canciones.
★ 1975+9Variación de estrellas de los últimos 7 días - #9
:zap: TensorFlowASR: Reconocimiento automático de voz casi de última generación en TensorFlow 2. Idiomas compatibles que pueden usar caracteres o subpalabras
★ 1010+0Variación de estrellas de los últimos 7 días - #10
Evalúe su sistema de conversión de voz a texto con medidas de similitud como la tasa de error de palabras (WER)
★ 926+3Variación de estrellas de los últimos 7 días - #11
Colección de recursos sobre las aplicaciones de modelos de lenguaje (LLM) en IA de audio.
★ 737+0Variación de estrellas de los últimos 7 días - #12
Reconocimiento de voz sin conexión con OpenAI Whisper y TensorFlow Lite para Android
★ 688+0Variación de estrellas de los últimos 7 días - #13
Motor de conversión de voz a texto en tiempo real ejecutado en el dispositivo mediante aprendizaje profundo.
★ 671+0Variación de estrellas de los últimos 7 días - #14
Un sistema ASR integral de grado industrial con módulos ASR, VAD, LID y Punc. FireRedASR2 admite chino (mandarín, más de 20 dialectos/acentos), inglés, cambio de código, y reconocimiento de voz y canto. FireRedVAD admite voz/canto/música en más de 100 idiomas. FireRedLID admite más de 100 idiomas y más de 20 dialectos chinos. FireRedPunc admite chino e inglés.
★ 664+7Variación de estrellas de los últimos 7 días