Saltar al contenido principal
buildradar
Sign in
Tema · transcription

transcription

Repositorios de código abierto monitorizados etiquetados con transcription, ordenados por estrellas.

Repositorios
53
Estrellas totales
175.951
Estrellas de media
3320
Proporción
0,01%

Temas que aparecen con frecuencia junto a transcription en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con transcription.

  • claude-real-video@HUANGCHIHHUNGLeo

    Permite que Claude (o cualquier LLM) vea realmente un video: fotogramas conscientes de escenas y deduplicados + transcripción, desde una URL o archivo local. Se ejecuta localmente, bajo licencia MIT.

    2109
  • rescript@wassgha

    Editor de video y audio de código abierto basado en transcripciones que funciona en el navegador.

    866
  • meetily@Zackriya-Solutions

    Asistente de reuniones de IA con prioridad en la privacidad, transcripción en vivo con Parakeet/Whisper 4 veces más rápida, diarización de hablantes y resumen con Ollama integrado en Rust. Procesamiento 100% local, sin necesidad de nube. Meetily (Meetly Ai - https://meetily.ai) es el anotador de reuniones de IA de código abierto y autohospedado número 1 para macOS y Windows. Comprende cómo redactar actas de reuniones

    30.252+195Variación de estrellas de los últimos 7 días
  • FunASR@modelscope

    Kit de herramientas de reconocimiento de voz de código abierto para entrenamiento, inferencia, ASR en streaming, VAD, puntuación, canalizaciones de diarización de altavoces y servicio compatible con OpenAI/MCP.

    20.136+64Variación de estrellas de los últimos 7 días
  • VoiceStudio@debpalash

    VoiceStudio es la alternativa a ElevenLabs de código abierto y totalmente local: clonación de voz, diseño de voz, doblaje de vídeo, dictado, transcripción y creación de audiolibros en 646 idiomas.

    14.835+2880Variación de estrellas de los últimos 7 días
  • omi@BasedHardware

    IA que ve tu pantalla, escucha tus conversaciones y te dice qué hacer

    13.377+46Variación de estrellas de los últimos 7 días
  • voice-pro@abus-aikorea

    Gradio WebUI para creadores y desarrolladores, con TTS clave (Edge-TTS, kokoro) y clonación de voz zero-shot (E2 & F5-TTS, CosyVoice), procesamiento de audio con Whisper, descarga de YouTube, aislamiento vocal con Demucs y traducción multilingüe.

    12.730+54Variación de estrellas de los últimos 7 días
  • SenseVoice@QwenAudio

    Modelo de código abierto SenseVoiceSmall para ASR en mandarín, cantonés, inglés, japonés y coreano, identificación de idiomas, reconocimiento de emociones y detección de eventos de audio.

    9209+37Variación de estrellas de los últimos 7 días
  • FunClip@modelscope

    Herramienta de transcripción de video, generación de subtítulos y recorte asistido por LLM basada en FunASR, con una interfaz de usuario local de Gradio

    6210+13Variación de estrellas de los últimos 7 días
  • basic-pitch@spotify

    Un conversor de audio a MIDI ligero pero potente con detección de flexión de tono (pitch bend)

    5522+21Variación de estrellas de los últimos 7 días
  • auto-subs@tmoroney

    Generación de subtítulos en el dispositivo que se conecta directamente con DaVinci Resolve, Premiere y After Effects.

    4122+20Variación de estrellas de los últimos 7 días
  • speaches@speaches-ai
    3638+8Variación de estrellas de los últimos 7 días
  • whishper@pluja

    Transcribe cualquier audio a texto, traduce y edita subtítulos 100% localmente con una interfaz de usuario web. ¡Impulsado por modelos whisper!

    3068+2Variación de estrellas de los últimos 7 días
  • Scriberr@rishikanthc

    Transcripción de audio con IA autoalojada

    3016+14Variación de estrellas de los últimos 7 días
  • Hex@kitlangton

    VOICE → WORDS

    2893+2Variación de estrellas de los últimos 7 días
  • vexa@Vexa-ai

    API de transcripción de reuniones de código abierto para Google Meet, Microsoft Teams y Zoom. Bots de unión automática, transcripciones en tiempo real por WebSocket, servidor MCP para agentes de IA. Autohospedado o mediante SaaS.

    2741+15Variación de estrellas de los últimos 7 días
  • awesome-whisper@sindresorhus

    🔊 Lista impresionante para Whisper, un sistema de reconocimiento de voz impulsado por IA de código abierto desarrollado por OpenAI

    2375+1Variación de estrellas de los últimos 7 días
  • kalosm@floneum

    Modelos de IA preentrenados locales, instantáneos y controlables en Rust

    2226+3Variación de estrellas de los últimos 7 días
  • noScribe@kaixxx

    Tecnología de IA de vanguardia para la transcripción de audio automatizada. Una excelente GUI para Whisper de OpenAI y pyannote (identificación de hablantes)

    2145+8Variación de estrellas de los últimos 7 días
  • claude-real-video@HUANGCHIHHUNGLeo

    Permite que Claude (o cualquier LLM) vea realmente un video: fotogramas conscientes de escenas y deduplicados + transcripción, desde una URL o archivo local. Se ejecuta localmente, bajo licencia MIT.

    2109+20Variación de estrellas de los últimos 7 días
  • diart@juanmc2005

    Un paquete de Python para crear aplicaciones de audio en tiempo real impulsadas por IA

    2024+1Variación de estrellas de los últimos 7 días
  • audapolis@bugbakery

    un editor para audio hablado con transcripción automática

    1892+2Variación de estrellas de los últimos 7 días
  • typewhisper-mac@TypeWhisper

    Conversión de voz a texto local para macOS mediante IA en el dispositivo, totalmente privada, con nube opcional

    1759+12Variación de estrellas de los últimos 7 días
  • Plugin de OBS para reconocimiento de voz y subtitulado local mediante IA.

    1597+8Variación de estrellas de los últimos 7 días
  • amical@amicalhq

    🎙️ Aplicación de dictado por IA - Código abierto y local-first ⚡ Escribe 3 veces más rápido, sin necesidad de teclado. 🆓 Impulsada por modelos de código abierto, funciona sin conexión, rápida y precisa.

    1520+8Variación de estrellas de los últimos 7 días
  • pianotrans@azuwis

    Interfaz gráfica sencilla para Piano Transcription with Pedals de ByteDance

    1514+3Variación de estrellas de los últimos 7 días
  • Fun-ASR@QwenAudio

    Familia de modelos ASR de código abierto basados en LLM para chino, dialectos, acentos y voz multilingüe, con motores de ejecución como FunASR, vLLM, streaming y llama.cpp.

    1512+10Variación de estrellas de los últimos 7 días
  • minutes@silverstein

    Cada reunión, cada idea, cada nota de voz, buscable por tu IA. Capa de memoria de conversación de código abierto y centrada en la privacidad.

    1462+6Variación de estrellas de los últimos 7 días
  • Aplicación Whisper con múltiples backends. Extremadamente rápida, optimizada para Mac-arm, fácil de instalar. Transcribe archivos locales o URLs usando Whisper AI de forma privada y gratuita.

    1394+0Variación de estrellas de los últimos 7 días
  • CrisperWhisper@nyrahealth

    Transcripción controlable. Literal (incluyendo muletillas, pausas, tartamudeos, sonidos vocales) o intencionada (lo que el hablante quiso decir, optimizado para legibilidad) con marcas de tiempo a nivel de palabra.

    1371+13Variación de estrellas de los últimos 7 días
  • book@hardhackerlabs

    Hard-core Hackers: El camino hacia $12,000 ARR en dos meses. Un registro detallado del desarrollo, lanzamiento y crecimiento del producto Podwise.

    1370+0Variación de estrellas de los últimos 7 días
  • Genera subtítulos para vídeo y audio, creando archivos SRT. Sin necesidad de solicitar APIs de terceros, implementa la transcripción de audio de forma local. Un marco de generación de subtítulos de vídeo basado en Transformer.

    1179+3Variación de estrellas de los últimos 7 días
← Volver a temas