Saltar al contenido principal
buildradar
Iniciar sesión
Tema · speech-to-text

speech-to-text

Repositorios de código abierto monitorizados etiquetados con speech-to-text, ordenados por estrellas.

152 repositorios
  • LiveStream-Agent-Studio@HanyuanWang

    面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。

    1018+424Variación de estrellas de los últimos 7 días
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Reconocimiento automático de voz casi de última generación en TensorFlow 2. Idiomas compatibles que pueden usar caracteres o subpalabras

    1010+0Variación de estrellas de los últimos 7 días
  • voquill@voquill

    Tecnología de dictado por voz de código abierto

    1006-1Variación de estrellas de los últimos 7 días
  • whisper-flow@dimastatz

    Whisper-Flow es un framework diseñado para permitir la transcripción en tiempo real de contenido de audio utilizando el modelo Whisper de OpenAI. En lugar de procesar archivos completos tras la carga ("modo por lotes"), Whisper-Flow acepta un flujo continuo de fragmentos de audio y produce transcripciones incrementales de inmediato.

    964+25Variación de estrellas de los últimos 7 días
  • VoiceStreamAI@alesaccoia

    Transcripción de audio en tiempo casi real usando Whisper autohospedado y WebSocket en Python/JS.

    960+0Variación de estrellas de los últimos 7 días
  • botium-speech-processing@codeforequity-at

    Procesamiento de voz Botium

    943+0Variación de estrellas de los últimos 7 días
  • whisper.net@sandrohanea

    Whisper.net. Conversión de voz a texto simplificada mediante modelos Whisper.

    942+1Variación de estrellas de los últimos 7 días
  • jiwer@jitsi

    Evalúe su sistema de conversión de voz a texto con medidas de similitud como la tasa de error de palabras (WER)

    928+2Variación de estrellas de los últimos 7 días
  • MauiSamples@VladislavAntonyuk

    Ejemplos de .NET MAUI.

    915+0Variación de estrellas de los últimos 7 días
  • voicy@backmeupplz

    Repositorio principal del bot de Telegram @voicybot.

    911+2Variación de estrellas de los últimos 7 días
  • TheWhisper@TheStageAI

    Modelos Whisper optimizados para streaming y uso en dispositivos.

    897-1Variación de estrellas de los últimos 7 días
  • TypeNo@marswaveai

    Aplicación de entrada de voz gratuita, de código abierto y centrada en la privacidad para macOS.

    896+4Variación de estrellas de los últimos 7 días
  • PPASR@yeyupiaoling

    Reconocimiento de voz en chino de extremo a extremo basado en PaddlePaddle, desde conceptos básicos hasta proyectos empresariales prácticos. Soporta modelos populares como DeepSpeech2, Conformer y Squeezeformer

    870-1Variación de estrellas de los últimos 7 días
  • react-speech-recognition@JamesBrill

    💬 Reconocimiento de voz para tu aplicación React

    842+0Variación de estrellas de los últimos 7 días
  • whisper-playground@saharmor

    Cree aplicaciones web de voz a texto en tiempo real utilizando Whisper de OpenAI https://openai.com/blog/whisper/

    835+0Variación de estrellas de los últimos 7 días
  • kur@deepgram

    Aprendizaje profundo descriptivo.

    823-1Variación de estrellas de los últimos 7 días
  • MioSub@corvo007

    Software de generación de subtítulos totalmente automatizado: cubre todo el proceso de descarga, transcripción, traducción y codificación sin intervención humana.

    811+3Variación de estrellas de los últimos 7 días
  • vocalinux@VocaHQ

    Dictado por voz gratuito, de código abierto y 100% offline para Linux. Habla y escribe en cualquier lugar mediante whisper.cpp, motores Whisper y VOSK, aceleración por GPU, funciona en X11 + Wayland.

    809+17Variación de estrellas de los últimos 7 días
  • lobe-tts@lobehub

    🎤 Lobe TTS - Una biblioteca de TTS/STT confiable y de alta calidad para servidor y navegador

    805-1Variación de estrellas de los últimos 7 días
  • Conversión de voz a texto y de texto a voz. Envía texto como mensajes OSC a VRChat para mostrarlo en el avatar.

    804+5Variación de estrellas de los últimos 7 días
  • june@mezbaul-h

    Chatbot de voz local para conversaciones atractivas, impulsado por Ollama, Hugging Face Transformers y Coqui TTS Toolkit

    788+1Variación de estrellas de los últimos 7 días
  • whisper_mic@mallorbc

    Proyecto que permite utilizar un micrófono con OpenAI Whisper.

    787+0Variación de estrellas de los últimos 7 días
  • SwiftWhisper@exPHAT

    La forma más sencilla de transcribir audio en Swift

    785+0Variación de estrellas de los últimos 7 días
  • NotelyVoice@Notely-Voice

    Una aplicación de transcripción de voz por IA 100% privada que convierte voz a texto en más de 100 idiomas. Creada con Compose Multiplatform para Android e iOS usando Whisper AI; sin subidas a la nube, todo el procesamiento ocurre en el dispositivo para una privacidad total.

    779+4Variación de estrellas de los últimos 7 días
  • mlx-audio-swift@Blaizzy

    Un SDK modular de Swift para procesamiento de audio con MLX en Apple Silicon.

    774+5Variación de estrellas de los últimos 7 días
  • BiBi-Keyboard@BryceWG

    BiBi Keyboard: Una aplicación de teclado para Android basada en Kotlin con LLM y entrada de voz ASR

    774+15Variación de estrellas de los últimos 7 días
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    Reconocimiento de voz en chino implementado con PaddlePaddle. Proyecto completo con buenos resultados de reconocimiento. Soporta entrenamiento y predicción en Windows y Linux, además de predicción en placas Nvidia Jetson.

    763+1Variación de estrellas de los últimos 7 días
  • chaplin@amanvirparhar

    Una herramienta de reconocimiento de voz silenciosa en tiempo real.

    754+1Variación de estrellas de los últimos 7 días
  • Ejecución de un modelo de voz a texto (whisper.cpp) en Unity3d en su máquina local.

    751+1Variación de estrellas de los últimos 7 días
  • Transcribro@soupslurpr

    Teclado y servicio de reconocimiento de voz privado y local para Android.

    745+2Variación de estrellas de los últimos 7 días
← Volver a temas