Aller au contenu principal
buildradar
Sign in
Sujet · table-extraction

table-extraction

Dépôts open source suivis étiquetés table-extraction, triés par étoiles.

Dépôts
8
Total d'étoiles
37 975
Étoiles en moyenne
4 747
Part
0,00%

Sujets qui apparaissent souvent aux côtés de table-extraction sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés table-extraction.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • pdfplumber@jsvine

    Analysez un PDF pour obtenir des informations détaillées sur chaque caractère, rectangle, ligne, etc., et extrayez facilement du texte et des tableaux.

    10 711+14Évolution des étoiles sur les 7 derniers jours
  • PyMuPDF@pymupdf

    PyMuPDF est une bibliothèque Python haute performance pour l'extraction, l'analyse, la conversion et la manipulation de documents PDF (et autres).

    10 628+48Évolution des étoiles sur les 7 derniers jours
  • xberg@xberg-io

    Framework d'intelligence documentaire polyglotte avec un cœur en Rust. Extrait le texte, les métadonnées, les images et les données structurées de 101 formats (115 extensions de fichiers) avec une intelligence de code pour 371 langages. 15 bindings de langages — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — ainsi qu'une CLI, une API REST et un serveur MCP.

    9 254+31Évolution des étoiles sur les 7 derniers jours
  • table-transformer@microsoft

    Table Transformer (TATR) est un modèle d'apprentissage profond pour extraire des tableaux de documents non structurés (PDF et images). Il s'agit également du dépôt officiel pour le jeu de données PubTables-1M et la métrique d'évaluation GriTS.

    2 943+4Évolution des étoiles sur les 7 derniers jours
  • docext@NanoNets

    Une boîte à outils sur site pour l'extraction de données non structurées sans OCR, la conversion en markdown et l'évaluation comparative.

    2 086+1Évolution des étoiles sur les 7 derniers jours
  • api-llm-ocr@yigitkonur

    Conversion de PDF en Markdown via des LLM de vision — préservation des tableaux, de la mise en page et de la structure

    901-1Évolution des étoiles sur les 7 derniers jours
  • img2table@xavctn

    img2table est une bibliothèque Python d'identification et d'extraction de tableaux pour PDF et images, basée sur le traitement d'image OpenCV

    895+2Évolution des étoiles sur les 7 derniers jours
  • ParseBench@run-llama

    ParseBench - Un benchmark d'analyse de documents pour les agents IA.

    559+6Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets