跳到主要内容
buildradar
Sign in
主题 · extract-data

extract-data

标记 extract-data 主题、收录中的开源项目,按星标数排序。

项目数
7
总星标数
102,336
平均星标数
14,619
占比
0.01%

常跟 extract-data 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 extract-data 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • MinerU@opendatalab

    将复杂文件(如 PDF 与 Office 文件)转换为适合 LLM 使用的 markdown/JSON,以供 Agentic 工作流程使用。

    79,045+298近 7 天星标变化
  • PyMuPDF@pymupdf

    PyMuPDF 是高性能的 Python 库,用于 PDF(及其他)文档的数据提取、分析、转换和操作。

    10,628+26近 7 天星标变化
  • node-crawler@bda-research

    NodeJS 的网页爬虫/蜘蛛,搭配服务器端 jQuery ;-)

    6,796-2近 7 天星标变化
  • meltano@meltano

    Meltano:声明式、代码优先的数据集成引擎,助力实现您最狂野的数据与 ML 驱动产品创意。告别编写、维护和扩展您自己的 API 集成。

    2,616+2近 7 天星标变化
  • documind@DocumindHQ

    使用 AI 从文件中提取结构化数据的开源平台。

    1,520-1近 7 天星标变化
  • crawly@elixir-crawly

    Crawly,一个适用于 Elixir 的高级网络爬虫与数据抓取框架。

    1,116+2近 7 天星标变化
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] 一种基于扩散模型的文件 OCR 框架,以区块级并行扩散解码取代自回归解码

    615+0近 7 天星标变化
← 返回主题列表