跳到主要內容
buildradar
Sign in
主題 · extract-data

extract-data

標記 extract-data 主題、收錄中的開源專案,依星數排序。

專案數
7
總星數
102,336
平均星數
14,619
佔比
0.01%

常跟 extract-data 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 extract-data 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • MinerU@opendatalab

    將複雜文件(如 PDF 與 Office 文件)轉換為適合 LLM 使用的 markdown/JSON,以供 Agentic 工作流程使用。

    79,045+298近 7 天星數變化
  • PyMuPDF@pymupdf

    PyMuPDF 是高效能的 Python 函式庫,用於 PDF(及其他)文件的資料擷取、分析、轉換與操作。

    10,628+26近 7 天星數變化
  • node-crawler@bda-research

    NodeJS 的網頁爬蟲/蜘蛛,搭配伺服器端 jQuery ;-)

    6,796-2近 7 天星數變化
  • meltano@meltano

    Meltano:宣告式、程式碼優先的資料整合引擎,助力實現您最狂野的資料與 ML 驅動產品創意。告別編寫、維護和擴充您自己的 API 整合。

    2,616+2近 7 天星數變化
  • documind@DocumindHQ

    使用 AI 從文件中萃取結構化資料的開源平台。

    1,520-1近 7 天星數變化
  • crawly@elixir-crawly

    Crawly,一個適用於 Elixir 的高階網路爬蟲與資料擷取框架。

    1,116+2近 7 天星數變化
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] 一種基於擴散模型的文件 OCR 框架,以區塊級平行擴散解碼取代自回歸解碼

    615+0近 7 天星數變化
← 返回主題列表