Saltar al contenido principal
buildradar
Sign in
Tema · ocr

ocr

Repositorios de código abierto monitorizados etiquetados con ocr, ordenados por estrellas.

186 repositorios
  • deepdoctection@deepdoctection

    Un repositorio para Document AI

    3257+9Variación de estrellas de los últimos 7 días
  • Pix2Text@breezedeus

    Una herramienta de Python3 de código abierto con modelos pequeños para reconocer diseños, tablas, fórmulas matemáticas (LaTeX) y texto en imágenes, convirtiéndolos al formato Markdown. Una alternativa gratuita a Mathpix, que permite una conversión fluida de contenido visual en representaciones basadas en texto. Soporta más de 80 idiomas.

    3229+3Variación de estrellas de los últimos 7 días
  • captcha_trainer@kerlomz

    [Reconocimiento de CAPTCHA - Entrenamiento] Este proyecto se basa en CNN/ResNet/DenseNet+GRU/LSTM+CTC/CrossEntropy para realizar el reconocimiento de códigos de verificación. Este proyecto es solo para entrenar el modelo.

    3213+0Variación de estrellas de los últimos 7 días
  • text-extract-api@CatchTheTornado

    API de extracción y análisis de documentos (PDF, Word, PPTX...) utilizando OCR modernos de última generación + modelos compatibles con Ollama. Anonimiza documentos. Elimina PII. Convierte cualquier documento o imagen en JSON o Markdown estructurado.

    3177+0Variación de estrellas de los últimos 7 días
  • gosseract@otiai10

    Paquete de Go para OCR (Reconocimiento Óptico de Caracteres), utilizando la librería C++ de Tesseract

    3134+2Variación de estrellas de los últimos 7 días
  • tools-ocr@AnyListen

    Reconocimiento de texto OCR Tree Hole (una pequeña herramienta OCR multiplataforma)

    3065+1Variación de estrellas de los últimos 7 días
  • tesseract-ocr-for-php@thiagoalessio

    Un envoltorio para trabajar con Tesseract OCR en PHP.

    3039-2Variación de estrellas de los últimos 7 días
  • Una colección seleccionada de proyectos prácticos de IA que implementan sistemas OCR, RAG, agentes de IA y otros casos de uso de IA.

    3030+58Variación de estrellas de los últimos 7 días
  • llm_aided_ocr@Dicklesworthstone

    Mejora la salida de Tesseract OCR usando LLMs (locales o API) para la corrección de errores, segmentación inteligente y formato markdown de PDFs escaneados

    2996+3Variación de estrellas de los últimos 7 días
  • markdownify-mcp@zcaceres

    Un servidor de Model Context Protocol para convertir casi cualquier cosa a Markdown

    2983-1Variación de estrellas de los últimos 7 días
  • CHINESE-OCR@xiaofengShi

    Detección y reconocimiento de texto en escenas chinas de extremo a extremo con CTPN, CRNN y CTC (proyecto heredado).

    2955+0Variación de estrellas de los últimos 7 días
  • openrecall@openrecall

    OpenRecall es una alternativa totalmente de código abierto y centrada en la privacidad a soluciones propietarias como Windows Recall de Microsoft. Con OpenRecall, puedes acceder fácilmente a tu historial digital, mejorando tu memoria y productividad sin comprometer tu privacidad.

    2937+2Variación de estrellas de los últimos 7 días
  • papermerge@ciur

    Sistema de gestión de documentos de código abierto para archivos digitales (documentos escaneados)

    2935+1Variación de estrellas de los últimos 7 días
  • comic-translate@ogkalu2

    Aplicación/extensión de navegador traductora de cómics y manga con IA para traducir automáticamente cómics, manga, manhwa, BD, fumetti y más en múltiples idiomas y formatos (imágenes, PDF, EPUB, CBR, CBZ, etc.).

    2928+12Variación de estrellas de los últimos 7 días
  • manga-ocr@kha-white

    Reconocimiento óptico de caracteres para texto en japonés, con enfoque principal en el manga japonés

    2770+7Variación de estrellas de los últimos 7 días
  • Herramienta de traducción de manga de código abierto basada en manga-image-translator. Soporta traducción automática de cómics japoneses, coreanos y estadounidenses, incluye 5 motores de traducción integrados como OpenAI y Gemini, y ofrece un editor visual para ajustar libremente el estilo del texto. Instalación con un solo clic, listo para usar. ¡Si te gusta, dale una ⭐ Star para apoyar!

    2711+35Variación de estrellas de los últimos 7 días
  • normcap@dynobo

    Herramienta de captura de pantalla basada en OCR para capturar información en lugar de imágenes

    2705+4Variación de estrellas de los últimos 7 días
  • Usa LLMs y LLM Vision (OCR) para gestionar paperless-ngx: digitalización de documentos impulsada por IA

    2662+8Variación de estrellas de los últimos 7 días
  • docs@sismics

    Sistema de gestión documental ligero equipado con todas las características que esperarías de soluciones grandes y costosas.

    2561+0Variación de estrellas de los últimos 7 días
  • ballerine@ballerine-io

    Plataforma de infraestructura y orquestación de datos de código abierto para la toma de decisiones de riesgo

    2427+1Variación de estrellas de los últimos 7 días
  • ade-cli@landing-ai

    La CLI oficial para Agentic Document Extraction (ADE) de LandingAI: analiza documentos y extrae datos con formato de esquema desde tu terminal

    2410+1Variación de estrellas de los últimos 7 días
  • comfyui_LLM_party@heshengtao

    Framework de agentes LLM en ComfyUI que incluye servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 y nodos de prompts para FLUX, acceso a Feishu, Discord, y se adapta a todos los LLM con interfaces similares a OpenAI / aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Adaptado a LLM locales, VLM, GGUF como llama-3.3 Janus-Pro, Linkage graphRAG

    2348+5Variación de estrellas de los últimos 7 días
  • docspell@eikek

    Ayuda a organizar tus pilas de documentos procedentes de escáneres, correos electrónicos y otras fuentes con el mínimo esfuerzo.

    2317+2Variación de estrellas de los últimos 7 días
  • gowall@Achno

    Una herramienta para convertir la combinación de colores o paleta de un fondo de pantalla, OCR con VLM tradicional e híbrido, compresión de imágenes, extracción de paletas de colores, mejora de resolución de imágenes con redes adversarias y más funciones de procesamiento de imágenes.

    2303+1Variación de estrellas de los últimos 7 días
  • retain-pdf@wxyhgk

    Traducción de PDF conservando el diseño, las fórmulas y la estructura, adecuada para documentos científicos y técnicos.

    2234+8Variación de estrellas de los últimos 7 días
  • SimpleHTR@githubharald

    Sistema de reconocimiento de texto escrito a mano (HTR) implementado con TensorFlow.

    2184+0Variación de estrellas de los últimos 7 días
  • deepseek-ocr.rs@TimmyOVO

    Motor OCR/VLM de múltiples backends en Rust (DeepSeek-OCR-1/2, PaddleOCR-VL, DotsOCR) con cuantificación DSQ y un servidor y CLI compatible con OpenAI: ejecútelo localmente sin Python.

    2184+1Variación de estrellas de los últimos 7 días
  • tesserocr@sirfz

    Un wrapper de Python para la API de tesseract-ocr

    2171+0Variación de estrellas de los últimos 7 días
  • obsidian-omnisearch@scambier

    Un motor de búsqueda que "simplemente funciona" para Obsidian. Soporta OCR e indexación de PDF.

    2131+2Variación de estrellas de los últimos 7 días
  • docext@NanoNets

    Un kit de herramientas local (on-premises), sin necesidad de OCR, para extracción de datos no estructurados, conversión a Markdown y pruebas de rendimiento. (https://idp-leaderboard.org/)

    2086-1Variación de estrellas de los últimos 7 días
← Volver a temas