Saltar al contenido principal
buildradar
Sign in
Tema · table-extraction

table-extraction

Repositorios de código abierto monitorizados etiquetados con table-extraction, ordenados por estrellas.

Repositorios
8
Estrellas totales
37.975
Estrellas de media
4747
Proporción
0,00%

Temas que aparecen con frecuencia junto a table-extraction en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con table-extraction.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • pdfplumber@jsvine

    Examina un PDF para obtener información detallada sobre cada carácter, rectángulo, línea, etc., y extrae fácilmente texto y tablas.

    10.711+14Variación de estrellas de los últimos 7 días
  • PyMuPDF@pymupdf

    PyMuPDF es una biblioteca de Python de alto rendimiento para la extracción, análisis, conversión y manipulación de documentos PDF (y otros).

    10.628+48Variación de estrellas de los últimos 7 días
  • xberg@xberg-io

    Un framework de inteligencia de documentos políglota con un núcleo en Rust. Extrae texto, metadatos, imágenes y datos estructurados de 101 formatos (115 extensiones de archivo) además de inteligencia de código para 371 lenguajes de programación. 15 enlaces de lenguajes — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — además de CLI, API REST y servidor MCP.

    9254+31Variación de estrellas de los últimos 7 días
  • table-transformer@microsoft

    Table Transformer (TATR) es un modelo de aprendizaje profundo para extraer tablas de documentos no estructurados (PDF e imágenes). Este es también el repositorio oficial para el conjunto de datos PubTables-1M y la métrica de evaluación GriTS.

    2943+4Variación de estrellas de los últimos 7 días
  • docext@NanoNets

    Un kit de herramientas local (on-premises), sin necesidad de OCR, para extracción de datos no estructurados, conversión a Markdown y pruebas de rendimiento. (https://idp-leaderboard.org/)

    2086+1Variación de estrellas de los últimos 7 días
  • api-llm-ocr@yigitkonur

    Conversión de PDF a markdown utilizando LLM de visión, preservando tablas, diseños y estructura.

    901-1Variación de estrellas de los últimos 7 días
  • img2table@xavctn

    img2table es una biblioteca de Python para la identificación y extracción de tablas en PDF e imágenes, basada en el procesamiento de imágenes de OpenCV.

    895+2Variación de estrellas de los últimos 7 días
  • ParseBench@run-llama

    ParseBench: un benchmark de análisis de documentos para agentes de IA

    559+6Variación de estrellas de los últimos 7 días
← Volver a temas