funasr
Repositorios de código abierto monitorizados etiquetados con funasr, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a funasr en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con funasr.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Kit de herramientas de reconocimiento de voz de código abierto para entrenamiento, inferencia, ASR en streaming, VAD, puntuación, canalizaciones de diarización de altavoces y servicio compatible con OpenAI/MCP.
★ 20.136+64Variación de estrellas de los últimos 7 días - #2
Modelo de código abierto SenseVoiceSmall para ASR en mandarín, cantonés, inglés, japonés y coreano, identificación de idiomas, reconocimiento de emociones y detección de eventos de audio.
★ 9209+37Variación de estrellas de los últimos 7 días - #3
Herramienta de transcripción de video, generación de subtítulos y recorte asistido por LLM basada en FunASR, con una interfaz de usuario local de Gradio
★ 6210+13Variación de estrellas de los últimos 7 días - #4
Aplicación de escritorio gratuita y de código abierto para generar, traducir, doblar y grabar subtítulos de video, con transcripción local mediante Whisper, doblaje por IA y clonación de voz, funcionamiento sin conexión y aceleración por GPU.
★ 4863+48Variación de estrellas de los últimos 7 días - #5
Extracción rápida de contenido de audio y video, organizado en notas de markdown estructuradas.
★ 2483+7Variación de estrellas de los últimos 7 días - #6
Alternativa abierta y gratuita a Wispr Flow | Flujo de trabajo de voz de escritorio en chino de próxima generación con integración del modelo local FunASR y modelos de lenguaje grande configurables
★ 2278+5Variación de estrellas de los últimos 7 días - #7
Bailing es un robot de conversación por voz similar a GPT-4o, implementado mediante ASR+LLM+TTS, que integra modelos avanzados como DeepSeek R1 y openClaw. Es un asistente de voz personal real con una latencia de hasta 800 ms, ejecutable en equipos de bajos recursos como Mac y con soporte para interrupciones.
★ 1759+2Variación de estrellas de los últimos 7 días - #8
Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.
★ 1512+10Variación de estrellas de los últimos 7 días - #9
MTools es una potente aplicación de escritorio multifuncional que integra procesamiento de audio y vídeo, edición de imágenes, operaciones de texto y herramientas de codificación, con funciones de IA integradas. Diseñado para simplificar tu flujo de trabajo y mejorar la productividad.
★ 1305+5Variación de estrellas de los últimos 7 días - #10
VocoType es una herramienta de entrada de voz local, privada y segura que permite convertir voz a texto en tiempo real mediante atajos de teclado e ingresarlo automáticamente en la aplicación actual. Admite MCP de voz a texto, optimización de texto por IA, diccionarios de reemplazo personalizados y transcripción de audio/video.
★ 928+9Variación de estrellas de los últimos 7 días - #11
Traducción de audio en tiempo real, captura audio del sistema y micrófono, ejecuta ASR (Whisper/SenseVoice) y traduce mediante la API de LLM con visualización en streaming. Ideal para VTubers, streamers y consumo de contenido extranjero.
★ 625+38Variación de estrellas de los últimos 7 días