Saltar al contenido principal
buildradar
Sign in
Tema · document-analysis

document-analysis

Repositorios de código abierto monitorizados etiquetados con document-analysis, ordenados por estrellas.

Repositorios
12
Estrellas totales
103.717
Estrellas de media
8643
Proporción
0,01%

Temas que aparecen con frecuencia junto a document-analysis en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con document-analysis.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • MinerU@opendatalab

    Transforma documentos complejos como PDFs y documentos de Office en markdown/JSON aptos para LLM para tus flujos de trabajo de Agentic.

    78.747+564Variación de estrellas de los últimos 7 días
  • Dolphin@bytedance

    El repositorio oficial de “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.

    9049-1Variación de estrellas de los últimos 7 días
  • docetl@ucbepic

    Un sistema para procesamiento de datos ETL impulsado por agentes de LLM

    4040+54Variación de estrellas de los últimos 7 días
  • PdfPig@UglyToad

    Lee y extrae texto y otro contenido de archivos PDF en C# (adaptación de PDFBox)

    2552+5Variación de estrellas de los últimos 7 días
  • docext@NanoNets

    Un kit de herramientas local (on-premises), sin necesidad de OCR, para extracción de datos no estructurados, conversión a Markdown y pruebas de rendimiento. (https://idp-leaderboard.org/)

    2086+4Variación de estrellas de los últimos 7 días
  • AdvancedLiterateMachinery@AlibabaResearch

    Una colección de ideas y algoritmos originales e innovadores hacia Advanced Literate Machinery. Este proyecto lo mantiene el equipo de OCR en el Language Technology Lab, Tongyi Lab, Alibaba Group.

    1834-1Variación de estrellas de los últimos 7 días
  • documind@DocumindHQ

    Plataforma de código abierto para extraer datos estructurados de documentos mediante IA.

    1520-1Variación de estrellas de los últimos 7 días
  • OpenOCR@Topdu

    OpenOCR: Un toolkit de código abierto para investigación y aplicaciones de OCR general, que integra un benchmark unificado de entrenamiento y evaluación, sistemas de OCR y análisis de documentos de nivel comercial, y reproducciones fieles de las implementaciones principales de una amplia gama de artículos académicos.

    1440+3Variación de estrellas de los últimos 7 días
  • dedoc@ispras

    Dedoc es una biblioteca (servicio) para automatizar el análisis de documentos y unificarlos en un formato estándar. Extrae automáticamente contenido, estructura lógica, tablas y metadatos de documentos electrónicos textuales.

    732+13Variación de estrellas de los últimos 7 días
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] Marco basado en difusión para OCR de documentos que reemplaza la decodificación autorregresiva con decodificación de difusión paralela a nivel de bloque.

    615+1Variación de estrellas de los últimos 7 días
  • PICK-pytorch@wenwenyu

    Código para el artículo "PICK: Extracción de información clave de documentos mediante redes convolucionales de aprendizaje gráfico mejoradas" (ICPR 2020).

    570+0Variación de estrellas de los últimos 7 días
  • assemblyline@CybercentreCanada

    AssemblyLine 4: Clasificación de archivos y análisis de malware

    531+3Variación de estrellas de los últimos 7 días
← Volver a temas