voice-recognition
Repositorios de código abierto monitorizados etiquetados con voice-recognition, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a voice-recognition en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con voice-recognition.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
API de reconocimiento de voz sin conexión para Android, iOS, Raspberry Pi y servidores con Python, Java, C# y Node.
★ 15.101+17Variación de estrellas de los últimos 7 días - #2
Kit de herramientas de voz fácil de usar que incluye modelo de aprendizaje autosupervisado, ASR de transmisión/SOTA con puntuación, TTS de transmisión con interfaz de texto, sistema de verificación de hablantes, traducción de voz de extremo a extremo y detección de palabras clave. Ganador del premio al mejor demo en NAACL2022.
★ 12.676+5Variación de estrellas de los últimos 7 días - #3
Un kit de herramientas de voz basado en PyTorch
★ 11.802+10Variación de estrellas de los últimos 7 días - #4
Voz a texto, reconocimiento de intenciones y texto a voz de muy baja latencia para construir agentes e interfaces de voz.
★ 10.997+33Variación de estrellas de los últimos 7 días - #5
Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado
★ 10.112+29Variación de estrellas de los últimos 7 días - #6
Una implementación casi en tiempo real de Whisper de OpenAI.
★ 4246+3Variación de estrellas de los últimos 7 días - #7
🇨🇳 Biblioteca de utilidades de caracteres chinos completa (pinyin, trazos, radicales, modismos, voz, visualización, etc.) (Chinese character util)
★ 3087+3Variación de estrellas de los últimos 7 días - #8
🐸STT - El kit de herramientas de aprendizaje profundo para conversión de voz a texto (Speech-to-Text). Entrenar y desplegar modelos STT nunca ha sido tan fácil.
★ 2606+1Variación de estrellas de los últimos 7 días - #9★ 2256+7Variación de estrellas de los últimos 7 días
- #10
🔊 Una lista completa de conjuntos de datos de código abierto para voz y computación de sonido (más de 95 conjuntos de datos).
★ 2223+1Variación de estrellas de los últimos 7 días - #11
Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.
★ 1399+0Variación de estrellas de los últimos 7 días - #12
Este proyecto utiliza diversos modelos avanzados de reconocimiento de huella vocal como EcapaTdnn, ResNetSE, ERes2Net, CAM++, entre otros, con soporte para más modelos en el futuro. También admite métodos de preprocesamiento de datos como MelSpectrogram y Spectrogram.
★ 1313+1Variación de estrellas de los últimos 7 días - #13
Asistente de IA en Python 🧠
★ 1014+0Variación de estrellas de los últimos 7 días - #14
Registro de capitán y mapa estelar 3D para Elite Dangerous.
★ 898+2Variación de estrellas de los últimos 7 días - #15
Motor de conversión de voz a intención en el dispositivo impulsado por aprendizaje profundo.
★ 711+2Variación de estrellas de los últimos 7 días - #16
Voicetypr: herramienta de dictado de voz a texto sin conexión basada en IA para fundadores, programadores y usuarios avanzados en macOS y Windows. Alternativa a wispr flow y superwhisper.
★ 707+12Variación de estrellas de los últimos 7 días - #17
Framework de evaluación comparativa de voz a texto.
★ 697+0Variación de estrellas de los últimos 7 días - #18
Reconocimiento de voz para proyectos de React Native Expo.
★ 676+5Variación de estrellas de los últimos 7 días - #19
Motor de conversión de voz a texto en tiempo real ejecutado en el dispositivo mediante aprendizaje profundo.
★ 671+0Variación de estrellas de los últimos 7 días - #20★ 638+0Variación de estrellas de los últimos 7 días
- #21
Traducción de audio en tiempo real, captura audio del sistema y micrófono, ejecuta ASR (Whisper/SenseVoice) y traduce mediante la API de LLM con visualización en streaming. Ideal para VTubers, streamers y consumo de contenido extranjero.
★ 621+34Variación de estrellas de los últimos 7 días - #22
Transcripción en tiempo real utilizando faster-whisper
★ 614+0Variación de estrellas de los últimos 7 días - #23
🗣 Una superposición que obtiene el permiso de voz del usuario y la entrada como texto en una interfaz de usuario personalizable
★ 557+1Variación de estrellas de los últimos 7 días