ocr
Repositorios de código abierto monitorizados etiquetados con ocr, ordenados por estrellas.
- #91
Un servidor OCR para iOS que utiliza el framework Vision de Apple.
★ 2029+19Variación de estrellas de los últimos 7 días - #92
Una interfaz Gtk/Qt para tesseract-ocr.
★ 1989+4Variación de estrellas de los últimos 7 días - #93★ 1900+3Variación de estrellas de los últimos 7 días
- #94★ 1879+3Variación de estrellas de los últimos 7 días
- #95
Un sistema OCR ligero basado en PaddleOCR, desacoplado del framework de entrenamiento de aprendizaje profundo PaddlePaddle, con una velocidad de inferencia ultrarrápida.
★ 1867+5Variación de estrellas de los últimos 7 días - #96
Una colección de ideas y algoritmos originales e innovadores hacia Advanced Literate Machinery. Este proyecto lo mantiene el equipo de OCR en el Language Technology Lab, Tongyi Lab, Alibaba Group.
★ 1835+1Variación de estrellas de los últimos 7 días - #97★ 1772-1Variación de estrellas de los últimos 7 días
- #98
Extracción de datos no estructurados rápida y eficiente. Escrito en Rust con bindings para múltiples lenguajes.
★ 1772+0Variación de estrellas de los últimos 7 días - #99★ 1761+0Variación de estrellas de los últimos 7 días
- #100★ 1739+6Variación de estrellas de los últimos 7 días
- #101★ 1720+8Variación de estrellas de los últimos 7 días
- #102
Forma declarativa de ejecutar modelos de IA en React Native en el dispositivo, impulsada por ExecuTorch.
★ 1707+5Variación de estrellas de los últimos 7 días - #103
MixTeX es una herramienta multimodal para LaTeX, chino-inglés y OCR de tablas. Realiza inferencia eficiente basada en CPU de forma local y sin conexión en Windows.
★ 1641+2Variación de estrellas de los últimos 7 días - #104
ExtractThinker es una librería de inteligencia de documentos para LLMs que ofrece interacción al estilo ORM para flujos de trabajo de documentos flexibles y potentes.
★ 1596+1Variación de estrellas de los últimos 7 días - #105
YomiToku es un paquete de análisis de imágenes de documentos impulsado por IA diseñado específicamente para el idioma japonés. YomitokuはAIを活用した日本語文書解析エンジンを提供するPythonパッケージです。
★ 1583+3Variación de estrellas de los últimos 7 días - #106
Colección de bibliotecas y herramientas de código abierto para la Automatización Robótica de Procesos (RPA), diseñadas para usarse con Robot Framework y Python.
★ 1555+0Variación de estrellas de los últimos 7 días - #107
Programa de línea de comandos de Windows para reconocimiento de texto de imágenes sin conexión OCR, que produce resultados en formato de cadena JSON, fácil de llamar por otros programas. Proporciona API en varios idiomas. Compilado por PaddleOCR C++.
★ 1544+1Variación de estrellas de los últimos 7 días - #108
Extrae y convierte datos de cualquier documento, imágenes, PDFs, documentos de Word, PPT o URL a múltiples formatos (Markdown, JSON, CSV, HTML) con extracción inteligente de datos estructurados y OCR avanzado.
★ 1534+1Variación de estrellas de los últimos 7 días - #109
Plataforma de código abierto para extraer datos estructurados de documentos mediante IA.
★ 1520-1Variación de estrellas de los últimos 7 días - #110
Una versión empaquetada y flexible del detector de texto CRAFT y el modelo de reconocimiento Keras CRNN.
★ 1473+0Variación de estrellas de los últimos 7 días - #111
OpenOCR: Un toolkit de código abierto para investigación y aplicaciones de OCR general, que integra un benchmark unificado de entrenamiento y evaluación, sistemas de OCR y análisis de documentos de nivel comercial, y reproducciones fieles de las implementaciones principales de una amplia gama de artículos académicos.
★ 1441+2Variación de estrellas de los últimos 7 días - #112
Un conjunto de notebooks y otros archivos que te ayudarán a aprender IA desde cero.
★ 1438+4Variación de estrellas de los últimos 7 días - #113
¿Cómo copiar texto de imágenes? La respuesta es TextSnatcher. Realiza operaciones de OCR en segundos en Linux Desktop.
★ 1387+0Variación de estrellas de los últimos 7 días - #114★ 1381+0Variación de estrellas de los últimos 7 días
- #115
Servidor de conversión de archivos autohospedado y consciente de los recursos, compatible con 488 formatos en 26 idiomas.
★ 1368+4Variación de estrellas de los últimos 7 días - #116
Reconocimiento de fórmulas matemáticas versión mejorada: fórmulas manuscritas e impresas en chino e inglés, con soporte para deducción de símbolos básicos (estructura de datos basada en el árbol de sintaxis abstracta de LaTeX).
★ 1311+1Variación de estrellas de los últimos 7 días - #117
Traducción al pasar el ratón para cualquier idioma - Extensión de Chrome: traductor de PDF, EBOOK, EPUB, OCR, TTS, NETFLIX, SUBTÍTULOS DUALES DE YOUTUBE, GOOGLE DOCS, IA, VISOR, GMAIL, ESCRITURA, IMAGEN, SUBTÍTULOS DUALES, MANGA, HOVER, DICCIONARIO, WEBTOON, EDGE, JAPONÉS, INGLÉS.
★ 1305+4Variación de estrellas de los últimos 7 días - #118
Captura de pantalla y grabación de pantalla de código abierto para macOS. La alternativa nativa y gratuita a CleanShot X. Construido con Swift 6.0 y SwiftUI.
★ 1284+11Variación de estrellas de los últimos 7 días - #119
Herramienta de investigación de código abierto para buscar, navegar, analizar y explorar grandes colecciones de documentos mediante un motor de búsqueda semántica y una plataforma de minería y análisis de texto de código abierto (integra ETL para procesamiento de documentos, OCR para imágenes y PDF, reconocimiento de entidades nombradas para personas, organizaciones y ubicaciones, gestión de metadatos mediante tesauros y ontologías, interfaz de usuario de búsqueda y aplicaciones de búsqueda para texto completo).
★ 1206+1Variación de estrellas de los últimos 7 días - #120
Inferencia de PaddleOCR en PyTorch. Convertido desde PaddleOCR.
★ 1205+0Variación de estrellas de los últimos 7 días