Saltar al contenido principal
buildradar
Sign in
Tema · automatic-speech-recognition

automatic-speech-recognition

Repositorios de código abierto monitorizados etiquetados con automatic-speech-recognition, ordenados por estrellas.

Repositorios
14
Estrellas totales
36.651
Estrellas de media
2618
Proporción
0,00%

Temas que aparecen con frecuencia junto a automatic-speech-recognition en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con automatic-speech-recognition.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • WhisperLiveKit@QuentinFuxa

    Voz a texto local en tiempo real con ASR en streaming, diarización de hablantes, traducción y API compatibles con OpenAI/Deepgram.

    10.974+75Variación de estrellas de los últimos 7 días
  • wenet@wenet-e2e

    Kit de herramientas de reconocimiento de voz de extremo a extremo listo para producción y centrado en la producción

    5228+4Variación de estrellas de los últimos 7 días
  • API de servicio web para OpenAI Whisper ASR

    3326+2Variación de estrellas de los últimos 7 días
  • GPA@AutoArk

    [AutoArk] ¡GPA (Audio de Propósito General) puede hacer reconocimiento de voz (ASR), síntesis de voz (TTS) y conversión de voz con un modelo diminuto!

    2897+305Variación de estrellas de los últimos 7 días
  • FluidAudio@FluidInference

    Modelos de audio CoreML de vanguardia en tus aplicaciones: texto a voz, voz a texto, detección de actividad de voz y diarización de hablantes. En Swift, impulsado por código abierto SOTA.

    2710+40Variación de estrellas de los últimos 7 días
  • STT@coqui-ai

    🐸STT - El kit de herramientas de aprendizaje profundo para conversión de voz a texto (Speech-to-Text). Entrenar y desplegar modelos STT nunca ha sido tan fácil.

    2605+1Variación de estrellas de los últimos 7 días
  • ten-vad@TEN-framework

    Detector de actividad de voz (VAD): baja latencia, alto rendimiento y ligero

    2253+4Variación de estrellas de los últimos 7 días
  • FireRedASR@FireRedTeam

    Modelos ASR de grado industrial de código abierto que admiten mandarín, dialectos chinos e inglés, logrando un nuevo SOTA en benchmarks públicos de ASR en mandarín, y ofreciendo además una capacidad excepcional de reconocimiento de letras de canciones.

    1975+9Variación de estrellas de los últimos 7 días
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Reconocimiento automático de voz casi de última generación en TensorFlow 2. Idiomas compatibles que pueden usar caracteres o subpalabras

    1010+0Variación de estrellas de los últimos 7 días
  • jiwer@jitsi

    Evalúe su sistema de conversión de voz a texto con medidas de similitud como la tasa de error de palabras (WER)

    926+3Variación de estrellas de los últimos 7 días
  • Colección de recursos sobre las aplicaciones de modelos de lenguaje (LLM) en IA de audio.

    737+0Variación de estrellas de los últimos 7 días
  • Reconocimiento de voz sin conexión con OpenAI Whisper y TensorFlow Lite para Android

    688+0Variación de estrellas de los últimos 7 días
  • cheetah@Picovoice

    Motor de conversión de voz a texto en tiempo real ejecutado en el dispositivo mediante aprendizaje profundo.

    671+0Variación de estrellas de los últimos 7 días
  • FireRedASR2S@FireRedTeam

    Un sistema ASR integral de grado industrial con módulos ASR, VAD, LID y Punc. FireRedASR2 admite chino (mandarín, más de 20 dialectos/acentos), inglés, cambio de código, y reconocimiento de voz y canto. FireRedVAD admite voz/canto/música en más de 100 idiomas. FireRedLID admite más de 100 idiomas y más de 20 dialectos chinos. FireRedPunc admite chino e inglés.

    664+7Variación de estrellas de los últimos 7 días
← Volver a temas