Saltar al contenido principal
buildradar
Sign in
Tema · voice-recognition

voice-recognition

Repositorios de código abierto monitorizados etiquetados con voice-recognition, ordenados por estrellas.

Repositorios
23
Estrellas totales
85.588
Estrellas de media
3721
Proporción
0,00%

Temas que aparecen con frecuencia junto a voice-recognition en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con voice-recognition.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • vosk-api@alphacep

    API de reconocimiento de voz sin conexión para Android, iOS, Raspberry Pi y servidores con Python, Java, C# y Node.

    15.101+17Variación de estrellas de los últimos 7 días
  • PaddleSpeech@PaddlePaddle

    Kit de herramientas de voz fácil de usar que incluye modelo de aprendizaje autosupervisado, ASR de transmisión/SOTA con puntuación, TTS de transmisión con interfaz de texto, sistema de verificación de hablantes, traducción de voz de extremo a extremo y detección de palabras clave. Ganador del premio al mejor demo en NAACL2022.

    12.676+5Variación de estrellas de los últimos 7 días
  • speechbrain@speechbrain

    Un kit de herramientas de voz basado en PyTorch

    11.802+10Variación de estrellas de los últimos 7 días
  • moonshine@moonshine-ai

    Voz a texto, reconocimiento de intenciones y texto a voz de muy baja latencia para construir agentes e interfaces de voz.

    10.997+33Variación de estrellas de los últimos 7 días
  • silero-vad@snakers4

    Silero VAD: Detector de actividad de voz de nivel empresarial preentrenado

    10.112+29Variación de estrellas de los últimos 7 días
  • WhisperLive@collabora

    Una implementación casi en tiempo real de Whisper de OpenAI.

    4246+3Variación de estrellas de los últimos 7 días
  • cnchar@theajack

    🇨🇳 Biblioteca de utilidades de caracteres chinos completa (pinyin, trazos, radicales, modismos, voz, visualización, etc.) (Chinese character util)

    3087+3Variación de estrellas de los últimos 7 días
  • STT@coqui-ai

    🐸STT - El kit de herramientas de aprendizaje profundo para conversión de voz a texto (Speech-to-Text). Entrenar y desplegar modelos STT nunca ha sido tan fácil.

    2606+1Variación de estrellas de los últimos 7 días
  • ten-vad@TEN-framework

    Detector de actividad de voz (VAD): baja latencia, alto rendimiento y ligero

    2256+7Variación de estrellas de los últimos 7 días
  • voice_datasets@jim-schwoebel

    🔊 Una lista completa de conjuntos de datos de código abierto para voz y computación de sonido (más de 95 conjuntos de datos).

    2223+1Variación de estrellas de los últimos 7 días
  • Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.

    1399+0Variación de estrellas de los últimos 7 días
  • Este proyecto utiliza diversos modelos avanzados de reconocimiento de huella vocal como EcapaTdnn, ResNetSE, ERes2Net, CAM++, entre otros, con soporte para más modelos en el futuro. También admite métodos de preprocesamiento de datos como MelSpectrogram y Spectrogram.

    1313+1Variación de estrellas de los últimos 7 días
  • Asistente de IA en Python 🧠

    1014+0Variación de estrellas de los últimos 7 días
  • EDDiscovery@EDDiscovery

    Registro de capitán y mapa estelar 3D para Elite Dangerous.

    898+2Variación de estrellas de los últimos 7 días
  • rhino@Picovoice

    Motor de conversión de voz a intención en el dispositivo impulsado por aprendizaje profundo.

    711+2Variación de estrellas de los últimos 7 días
  • voicetypr@moinulmoin

    Voicetypr: herramienta de dictado de voz a texto sin conexión basada en IA para fundadores, programadores y usuarios avanzados en macOS y Windows. Alternativa a wispr flow y superwhisper.

    707+12Variación de estrellas de los últimos 7 días
  • Framework de evaluación comparativa de voz a texto.

    697+0Variación de estrellas de los últimos 7 días
  • Reconocimiento de voz para proyectos de React Native Expo.

    676+5Variación de estrellas de los últimos 7 días
  • cheetah@Picovoice

    Motor de conversión de voz a texto en tiempo real ejecutado en el dispositivo mediante aprendizaje profundo.

    671+0Variación de estrellas de los últimos 7 días
  • sonus@evancohen

    STT (speech to text) para Node con detección de palabras clave sin conexión

    638+0Variación de estrellas de los últimos 7 días
  • LiveTranslate@TheDeathDragon

    Traducción de audio en tiempo real, captura audio del sistema y micrófono, ejecuta ASR (Whisper/SenseVoice) y traduce mediante la API de LLM con visualización en streaming. Ideal para VTubers, streamers y consumo de contenido extranjero.

    621+34Variación de estrellas de los últimos 7 días
  • speech-to-text@reriiasu

    Transcripción en tiempo real utilizando faster-whisper

    614+0Variación de estrellas de los últimos 7 días
  • 🗣 Una superposición que obtiene el permiso de voz del usuario y la entrada como texto en una interfaz de usuario personalizable

    557+1Variación de estrellas de los últimos 7 días
← Volver a temas