ocr
Repositorios de código abierto monitorizados etiquetados con ocr, ordenados por estrellas.
- #61
Un repositorio para Document AI
★ 3257+9Variación de estrellas de los últimos 7 días - #62
Una herramienta de Python3 de código abierto con modelos pequeños para reconocer diseños, tablas, fórmulas matemáticas (LaTeX) y texto en imágenes, convirtiéndolos al formato Markdown. Una alternativa gratuita a Mathpix, que permite una conversión fluida de contenido visual en representaciones basadas en texto. Soporta más de 80 idiomas.
★ 3229+3Variación de estrellas de los últimos 7 días - #63
[Reconocimiento de CAPTCHA - Entrenamiento] Este proyecto se basa en CNN/ResNet/DenseNet+GRU/LSTM+CTC/CrossEntropy para realizar el reconocimiento de códigos de verificación. Este proyecto es solo para entrenar el modelo.
★ 3213+0Variación de estrellas de los últimos 7 días - #64
API de extracción y análisis de documentos (PDF, Word, PPTX...) utilizando OCR modernos de última generación + modelos compatibles con Ollama. Anonimiza documentos. Elimina PII. Convierte cualquier documento o imagen en JSON o Markdown estructurado.
★ 3177+0Variación de estrellas de los últimos 7 días - #65
Paquete de Go para OCR (Reconocimiento Óptico de Caracteres), utilizando la librería C++ de Tesseract
★ 3134+2Variación de estrellas de los últimos 7 días - #66
Reconocimiento de texto OCR Tree Hole (una pequeña herramienta OCR multiplataforma)
★ 3065+1Variación de estrellas de los últimos 7 días - #67
Un envoltorio para trabajar con Tesseract OCR en PHP.
★ 3039-2Variación de estrellas de los últimos 7 días - #68
Una colección seleccionada de proyectos prácticos de IA que implementan sistemas OCR, RAG, agentes de IA y otros casos de uso de IA.
★ 3030+58Variación de estrellas de los últimos 7 días - #69
Mejora la salida de Tesseract OCR usando LLMs (locales o API) para la corrección de errores, segmentación inteligente y formato markdown de PDFs escaneados
★ 2996+3Variación de estrellas de los últimos 7 días - #70
Un servidor de Model Context Protocol para convertir casi cualquier cosa a Markdown
★ 2983-1Variación de estrellas de los últimos 7 días - #71
Detección y reconocimiento de texto en escenas chinas de extremo a extremo con CTPN, CRNN y CTC (proyecto heredado).
★ 2955+0Variación de estrellas de los últimos 7 días - #72
OpenRecall es una alternativa totalmente de código abierto y centrada en la privacidad a soluciones propietarias como Windows Recall de Microsoft. Con OpenRecall, puedes acceder fácilmente a tu historial digital, mejorando tu memoria y productividad sin comprometer tu privacidad.
★ 2937+2Variación de estrellas de los últimos 7 días - #73
Sistema de gestión de documentos de código abierto para archivos digitales (documentos escaneados)
★ 2935+1Variación de estrellas de los últimos 7 días - #74
Aplicación/extensión de navegador traductora de cómics y manga con IA para traducir automáticamente cómics, manga, manhwa, BD, fumetti y más en múltiples idiomas y formatos (imágenes, PDF, EPUB, CBR, CBZ, etc.).
★ 2928+12Variación de estrellas de los últimos 7 días - #75
Reconocimiento óptico de caracteres para texto en japonés, con enfoque principal en el manga japonés
★ 2770+7Variación de estrellas de los últimos 7 días - #76
Herramienta de traducción de manga de código abierto basada en manga-image-translator. Soporta traducción automática de cómics japoneses, coreanos y estadounidenses, incluye 5 motores de traducción integrados como OpenAI y Gemini, y ofrece un editor visual para ajustar libremente el estilo del texto. Instalación con un solo clic, listo para usar. ¡Si te gusta, dale una ⭐ Star para apoyar!
★ 2711+35Variación de estrellas de los últimos 7 días - #77
Herramienta de captura de pantalla basada en OCR para capturar información en lugar de imágenes
★ 2705+4Variación de estrellas de los últimos 7 días - #78
Usa LLMs y LLM Vision (OCR) para gestionar paperless-ngx: digitalización de documentos impulsada por IA
★ 2662+8Variación de estrellas de los últimos 7 días - #79
Sistema de gestión documental ligero equipado con todas las características que esperarías de soluciones grandes y costosas.
★ 2561+0Variación de estrellas de los últimos 7 días - #80
Plataforma de infraestructura y orquestación de datos de código abierto para la toma de decisiones de riesgo
★ 2427+1Variación de estrellas de los últimos 7 días - #81
La CLI oficial para Agentic Document Extraction (ADE) de LandingAI: analiza documentos y extrae datos con formato de esquema desde tu terminal
★ 2410+1Variación de estrellas de los últimos 7 días - #82
Framework de agentes LLM en ComfyUI que incluye servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 y nodos de prompts para FLUX, acceso a Feishu, Discord, y se adapta a todos los LLM con interfaces similares a OpenAI / aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao. Adaptado a LLM locales, VLM, GGUF como llama-3.3 Janus-Pro, Linkage graphRAG
★ 2348+5Variación de estrellas de los últimos 7 días - #83
Ayuda a organizar tus pilas de documentos procedentes de escáneres, correos electrónicos y otras fuentes con el mínimo esfuerzo.
★ 2317+2Variación de estrellas de los últimos 7 días - #84
Una herramienta para convertir la combinación de colores o paleta de un fondo de pantalla, OCR con VLM tradicional e híbrido, compresión de imágenes, extracción de paletas de colores, mejora de resolución de imágenes con redes adversarias y más funciones de procesamiento de imágenes.
★ 2303+1Variación de estrellas de los últimos 7 días - #85
Traducción de PDF conservando el diseño, las fórmulas y la estructura, adecuada para documentos científicos y técnicos.
★ 2234+8Variación de estrellas de los últimos 7 días - #86
Sistema de reconocimiento de texto escrito a mano (HTR) implementado con TensorFlow.
★ 2184+0Variación de estrellas de los últimos 7 días - #87
Motor OCR/VLM de múltiples backends en Rust (DeepSeek-OCR-1/2, PaddleOCR-VL, DotsOCR) con cuantificación DSQ y un servidor y CLI compatible con OpenAI: ejecútelo localmente sin Python.
★ 2184+1Variación de estrellas de los últimos 7 días - #88★ 2171+0Variación de estrellas de los últimos 7 días
- #89
Un motor de búsqueda que "simplemente funciona" para Obsidian. Soporta OCR e indexación de PDF.
★ 2131+2Variación de estrellas de los últimos 7 días - #90
Un kit de herramientas local (on-premises), sin necesidad de OCR, para extracción de datos no estructurados, conversión a Markdown y pruebas de rendimiento. (https://idp-leaderboard.org/)
★ 2086-1Variación de estrellas de los últimos 7 días