跳到主要內容
buildradar
Sign in
主題 · table-extraction

table-extraction

標記 table-extraction 主題、收錄中的開源專案,依星數排序。

專案數
8
總星數
37,975
平均星數
4,747
佔比
0.00%

常跟 table-extraction 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 table-extraction 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • pdfplumber@jsvine

    提供 PDF 以取得每個字元、矩形、線條等的詳細資訊,並輕鬆擷取文字與表格。

    10,711+14近 7 天星數變化
  • PyMuPDF@pymupdf

    PyMuPDF 是高效能的 Python 函式庫,用於 PDF(及其他)文件的資料擷取、分析、轉換與操作。

    10,628+48近 7 天星數變化
  • xberg@xberg-io

    具 Rust 核心的多語言文件智慧框架。從 101 種格式(115 種檔案副檔名)提取文字、元資料、影像與結構化資料,並支援 371 種程式語言的程式碼智慧。提供 15 種語言綁定 — Rust、Python、Ruby、Java、Go、PHP、Elixir、C#、TypeScript — 以及 CLI、REST API 與 MCP 伺服器

    9,254+31近 7 天星數變化
  • table-transformer@microsoft

    Table Transformer (TATR) 是一款用於從非結構化文件(PDF 和圖片)中擷取表格的深度學習模型。這也是 PubTables-1M 資料集和 GriTS 評估指標的官方儲存庫。

    2,943+4近 7 天星數變化
  • docext@NanoNets

    本地部署、無需 OCR 的非結構化資料萃取、Markdown 轉換與基準測試工具包。(https://idp-leaderboard.org/)

    2,086+1近 7 天星數變化
  • api-llm-ocr@yigitkonur

    使用視覺 LLM 將 PDF 轉為 markdown — 保留表格、版面與結構

    902-1近 7 天星數變化
  • img2table@xavctn

    img2table 是一個基於 OpenCV 影像處理的 PDF 與圖片表格辨識和萃取 Python 函式庫

    894+2近 7 天星數變化
  • ParseBench@run-llama

    ParseBench - 用於 AI Agent 的文件解析基準測試。

    563+6近 7 天星數變化
← 返回主題列表