跳到主要内容
buildradar
Sign in
主题 · table-extraction

table-extraction

标记 table-extraction 主题、收录中的开源项目,按星标数排序。

项目数
8
总星标数
37,975
平均星标数
4,747
占比
0.00%

常跟 table-extraction 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 table-extraction 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • pdfplumber@jsvine

    提供 PDF 以获取每个字符、矩形、线条等的详细信息,并轻松提取文本和表格。

    10,711+10近 7 天星标变化
  • PyMuPDF@pymupdf

    PyMuPDF 是高性能的 Python 库,用于 PDF(及其他)文档的数据提取、分析、转换和操作。

    10,628+26近 7 天星标变化
  • xberg@xberg-io

    具 Rust 核心的多语言文档智能框架。从 101 种格式(115 种文件扩展名)提取文本、元数据、图像和结构化数据,并支持 371 种代码语言的代码智能。提供 15 种语言绑定 — Rust、Python、Ruby、Java、Go、PHP、Elixir、C#、TypeScript — 以及 CLI、REST API 与 MCP 服务器

    9,254+21近 7 天星标变化
  • table-transformer@microsoft

    Table Transformer (TATR) 是一款用于从非结构化文档(PDF 和图片)中提取表格的深度学习模型。这也是 PubTables-1M 数据集和 GriTS 评估指标的官方仓库。

    2,943+3近 7 天星标变化
  • docext@NanoNets

    本地部署、无需 OCR 的非结构化数据提取、Markdown 转换与基准测试工具包。(https://idp-leaderboard.org/)

    2,086-1近 7 天星标变化
  • api-llm-ocr@yigitkonur

    使用视觉 LLM 将 PDF 转为 markdown — 保留表格、排版与结构

    902+1近 7 天星标变化
  • img2table@xavctn

    img2table 是一个基于 OpenCV 图像处理的 PDF 与图片表格识别和提取 Python 库

    894+1近 7 天星标变化
  • ParseBench@run-llama

    ParseBench - 用于 AI Agent 的文档解析基准测试。

    565+12近 7 天星标变化
← 返回主题列表