transcription
Repositorios de código abierto monitorizados etiquetados con transcription, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a transcription en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con transcription.
- #1
Permite que Claude (o cualquier LLM) vea realmente un video: fotogramas conscientes de escenas y deduplicados + transcripción, desde una URL o archivo local. Se ejecuta localmente, bajo licencia MIT.
★ 2109 - #2
Editor de video y audio de código abierto basado en transcripciones que funciona en el navegador.
★ 866
- #1
Asistente de reuniones de IA con prioridad en la privacidad, transcripción en vivo con Parakeet/Whisper 4 veces más rápida, diarización de hablantes y resumen con Ollama integrado en Rust. Procesamiento 100% local, sin necesidad de nube. Meetily (Meetly Ai - https://meetily.ai) es el anotador de reuniones de IA de código abierto y autohospedado número 1 para macOS y Windows. Comprende cómo redactar actas de reuniones
★ 30.252+195Variación de estrellas de los últimos 7 días - #2
Kit de herramientas de reconocimiento de voz de código abierto para entrenamiento, inferencia, ASR en streaming, VAD, puntuación, canalizaciones de diarización de altavoces y servicio compatible con OpenAI/MCP.
★ 20.136+64Variación de estrellas de los últimos 7 días - #3
VoiceStudio es la alternativa a ElevenLabs de código abierto y totalmente local: clonación de voz, diseño de voz, doblaje de vídeo, dictado, transcripción y creación de audiolibros en 646 idiomas.
★ 14.835+2880Variación de estrellas de los últimos 7 días - #4★ 13.377+46Variación de estrellas de los últimos 7 días
- #5
Gradio WebUI para creadores y desarrolladores, con TTS clave (Edge-TTS, kokoro) y clonación de voz zero-shot (E2 & F5-TTS, CosyVoice), procesamiento de audio con Whisper, descarga de YouTube, aislamiento vocal con Demucs y traducción multilingüe.
★ 12.730+54Variación de estrellas de los últimos 7 días - #6
Modelo de código abierto SenseVoiceSmall para ASR en mandarín, cantonés, inglés, japonés y coreano, identificación de idiomas, reconocimiento de emociones y detección de eventos de audio.
★ 9209+37Variación de estrellas de los últimos 7 días - #7
Herramienta de transcripción de video, generación de subtítulos y recorte asistido por LLM basada en FunASR, con una interfaz de usuario local de Gradio
★ 6210+13Variación de estrellas de los últimos 7 días - #8
Un conversor de audio a MIDI ligero pero potente con detección de flexión de tono (pitch bend)
★ 5522+21Variación de estrellas de los últimos 7 días - #9
Generación de subtítulos en el dispositivo que se conecta directamente con DaVinci Resolve, Premiere y After Effects.
★ 4122+20Variación de estrellas de los últimos 7 días - #10★ 3638+8Variación de estrellas de los últimos 7 días
- #11
Transcribe cualquier audio a texto, traduce y edita subtítulos 100% localmente con una interfaz de usuario web. ¡Impulsado por modelos whisper!
★ 3068+2Variación de estrellas de los últimos 7 días - #12★ 3016+14Variación de estrellas de los últimos 7 días
- #13★ 2893+2Variación de estrellas de los últimos 7 días
- #14
API de transcripción de reuniones de código abierto para Google Meet, Microsoft Teams y Zoom. Bots de unión automática, transcripciones en tiempo real por WebSocket, servidor MCP para agentes de IA. Autohospedado o mediante SaaS.
★ 2741+15Variación de estrellas de los últimos 7 días - #15
🔊 Lista impresionante para Whisper, un sistema de reconocimiento de voz impulsado por IA de código abierto desarrollado por OpenAI
★ 2375+1Variación de estrellas de los últimos 7 días - #16★ 2226+3Variación de estrellas de los últimos 7 días
- #17
Tecnología de IA de vanguardia para la transcripción de audio automatizada. Una excelente GUI para Whisper de OpenAI y pyannote (identificación de hablantes)
★ 2145+8Variación de estrellas de los últimos 7 días - #18
Permite que Claude (o cualquier LLM) vea realmente un video: fotogramas conscientes de escenas y deduplicados + transcripción, desde una URL o archivo local. Se ejecuta localmente, bajo licencia MIT.
★ 2109+20Variación de estrellas de los últimos 7 días - #19
Un paquete de Python para crear aplicaciones de audio en tiempo real impulsadas por IA
★ 2024+1Variación de estrellas de los últimos 7 días - #20★ 1892+2Variación de estrellas de los últimos 7 días
- #21
Conversión de voz a texto local para macOS mediante IA en el dispositivo, totalmente privada, con nube opcional
★ 1759+12Variación de estrellas de los últimos 7 días - #22
Plugin de OBS para reconocimiento de voz y subtitulado local mediante IA.
★ 1597+8Variación de estrellas de los últimos 7 días - #23
🎙️ Aplicación de dictado por IA - Código abierto y local-first ⚡ Escribe 3 veces más rápido, sin necesidad de teclado. 🆓 Impulsada por modelos de código abierto, funciona sin conexión, rápida y precisa.
★ 1520+8Variación de estrellas de los últimos 7 días - #24
Interfaz gráfica sencilla para Piano Transcription with Pedals de ByteDance
★ 1514+3Variación de estrellas de los últimos 7 días - #25
Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.
★ 1512+10Variación de estrellas de los últimos 7 días - #26
Cada reunión, cada idea, cada nota de voz, buscable por tu IA. Capa de memoria de conversación de código abierto y centrada en la privacidad.
★ 1462+6Variación de estrellas de los últimos 7 días - #27
Aplicación Whisper con múltiples backends. Extremadamente rápida, optimizada para Mac-arm, fácil de instalar. Transcribe archivos locales o URLs usando Whisper AI de forma privada y gratuita.
★ 1394+0Variación de estrellas de los últimos 7 días - #28
Transcripción controlable. Literal (incluyendo muletillas, pausas, tartamudeos, sonidos vocales) o intencionada (lo que el hablante quiso decir, optimizado para legibilidad) con marcas de tiempo a nivel de palabra.
★ 1371+13Variación de estrellas de los últimos 7 días - #29
Hard-core Hackers: El camino hacia $12,000 ARR en dos meses. Un registro detallado del desarrollo, lanzamiento y crecimiento del producto Podwise.
★ 1370+0Variación de estrellas de los últimos 7 días - #30
Genera subtítulos para vídeo y audio, creando archivos SRT. Sin necesidad de solicitar APIs de terceros, implementa la transcripción de audio de forma local. Un marco de generación de subtítulos de vídeo basado en Transformer.
★ 1179+3Variación de estrellas de los últimos 7 días