ocr
Repositorios de código abierto monitorizados etiquetados con ocr, ordenados por estrellas.
- #31
Ingesta, analiza y optimiza cualquier formato de datos ➡️ desde documentos hasta multimedia ➡️ para una mayor compatibilidad con frameworks de GenAI
★ 7823+4Variación de estrellas de los últimos 7 días - #32
📄 Herramienta de OCR Awesome basada en múltiples lenguajes de programación utilizando ONNX Runtime, OpenVINO, MNN, PaddlePaddle, TensorRT y PyTorch.
★ 7664+47Variación de estrellas de los últimos 7 días - #33
Modelos entrenados con una variante rápida de los "mejores" modelos LSTM + modelos heredados
★ 7647+4Variación de estrellas de los últimos 7 días - #34★ 7385+11Variación de estrellas de los últimos 7 días
- #35
Extracción de datos no estructurados impulsada por LLM — Diseñada para despliegues de API y flujos de trabajo de canalizaciones ETL
★ 7191+9Variación de estrellas de los últimos 7 días - #36
Captura de pantalla, OCR sin conexión, búsqueda y traducción, búsqueda por imagen, imágenes fijas, grabación de pantalla, captura de pantalla con desplazamiento omnidireccional, traducción de pantalla. Es compatible con Windows, Linux y macOS.
★ 7066+18Variación de estrellas de los últimos 7 días - #37
Implementación oficial de OCR-free Document Understanding Transformer (Donut) y Synthetic Document Generator (SynthDoG), ECCV 2022
★ 6917-2Variación de estrellas de los últimos 7 días - #38
docTR (Document Text Recognition): una biblioteca fluida, de alto rendimiento y accesible para tareas relacionadas con OCR impulsada por Deep Learning. Desarrollo y mantenimiento continuos por t2k.
★ 6335+12Variación de estrellas de los últimos 7 días - #39★ 6254+3Variación de estrellas de los últimos 7 días
- #40
PDF craft puede convertir archivos PDF a varios otros formatos. Este proyecto se centrará en el procesamiento de archivos PDF de libros escaneados.
★ 6245+13Variación de estrellas de los últimos 7 días - #41★ 6176-2Variación de estrellas de los últimos 7 días
- #42
Un conjunto de herramientas unificado para el análisis de imágenes de documentos basado en aprendizaje profundo
★ 5776+2Variación de estrellas de los últimos 7 días - #43
Traductor de pantalla avanzado en tiempo real para juegos, subtítulos incrustados en videos, texto estático y más.
★ 5722+13Variación de estrellas de los últimos 7 días - #44
Formato FlyingMouse: Herramienta gratuita de conversión de formatos de archivo para Windows (disponible sin conexión, incluye FFmpeg/LibreOffice/Poppler/Tesseract). Conversión cruzada de imágenes, documentos, hojas de cálculo, PPT, PDF, audio/video y WPS + OCR + conversión por lote; el audio solo admite formatos comunes. Autor: LaoFeng | Solo para uso personal y gratuito, prohibida la venta comercial, reventa o empaquetado.
★ 5589+615Variación de estrellas de los últimos 7 días - #45
Herramienta de traducción de cómics asistida por deep learning, compatible con traducción automática en un clic y edición simple de imágenes y texto
★ 5096+18Variación de estrellas de los últimos 7 días - #46
Usa OCR en Windows de forma rápida y sencilla con Text Grab. Con proceso en segundo plano y notificaciones opcionales.
★ 4985+5Variación de estrellas de los últimos 7 días - #47
Repositorio de Snow Apps, que proporciona código fuente para Snow Shot y Snow Image Viewer.
★ 4934+6Variación de estrellas de los últimos 7 días - #48
Caja de herramientas de OpenMMLab para detección, reconocimiento y comprensión de texto
★ 4752-1Variación de estrellas de los últimos 7 días - #49★ 4681+20Variación de estrellas de los últimos 7 días
- #50
TNN: desarrollado por Tencent Youtu Lab y Guangying Lab, un framework de inferencia de aprendizaje profundo uniforme para móviles, escritorio y servidores. TNN se destaca por varias características sobresalientes, incluyendo su capacidad multiplataforma, alto rendimiento, compresión de modelos y poda de código. Basado en ncnn y Rapidnet, TNN refuerza aún más el soporte y la optimización de rendimiento para dispositivos móviles, y también
★ 4649+1Variación de estrellas de los últimos 7 días - #51★ 4481+9Variación de estrellas de los últimos 7 días
- #52
RuVector es una base de datos de memoria Vector GNN, IA de autoaprendizaje en tiempo real y de alto rendimiento, construida en Rust.
★ 4473+6Variación de estrellas de los últimos 7 días - #53
El reproductor de medios para el aprendizaje de idiomas, con subtítulos duales, subtítulos generados por IA, traducción en tiempo real ¡y más!
★ 4070+12Variación de estrellas de los últimos 7 días - #54
Reconocimiento de texto (reconocimiento óptico de caracteres) con métodos de aprendizaje profundo, ICCV 2019
★ 3942+0Variación de estrellas de los últimos 7 días - #55
El primer plugin de visión para DeepSeek Harness, y el puente de visión para cada agente de codificación de solo texto. Pega una imagen, obtén evidencia JSON estructurada (OCR, diseño, semántica). | El plugin de visión externo más potente de toda la red para DeepSeek Harness, que aporta capacidades de visión a modelos de solo texto como DeepSeek y GLM; pega una imagen para obtener evidencia JSON estructurada (OCR, diseño, semántica).
★ 3839+83Variación de estrellas de los últimos 7 días - #56
Editor de PDF gratuito y de código abierto para Windows. Permite ver, anotar, usar OCR, fusionar, dividir, editar texto, dibujar, firmar, rellenar formularios, imprimir, aplanar y abrir PDFs protegidos con contraseña sin suscripción. Instálalo o ejecútalo en versión portable. GPLv3
★ 3749+63Variación de estrellas de los últimos 7 días - #57
Un generador de datos sintéticos para el reconocimiento de texto
★ 3693+2Variación de estrellas de los últimos 7 días - #58
AdelaiDet es una caja de herramientas de código abierto para múltiples tareas de detección y reconocimiento a nivel de instancia.
★ 3477+0Variación de estrellas de los últimos 7 días - #59
Implementación oficial de Character Region Awareness for Text Detection (CRAFT)
★ 3398-1Variación de estrellas de los últimos 7 días - #60
🚀 Capturas de pantalla, marcado de palabras, OCR, IA, software de traducción || 截图、划词、文字识别、AI、翻译软件
★ 3355+7Variación de estrellas de los últimos 7 días