跳到主要内容
buildradar
Sign in
主题 · pdf-extraction

pdf-extraction

标记 pdf-extraction 主题、收录中的开源项目,按星标数排序。

项目数
9
总星标数
67,687
平均星标数
7,521
占比
0.00%

常跟 pdf-extraction 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 pdf-extraction 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • opendataloader-pdf@opendataloader-project

    PDF 解析器,将数据转为 AI 可用格式。自动化 PDF 可访问性。开源。

    28,905+49近 7 天星标变化
  • pdf-inspector@firecrawl

    快速的 Rust PDF 检测、分类与文字提取库,能智能辨别扫描版与文字版 PDF,帮助做出智能路由决策。

    18,547+1,664近 7 天星标变化
  • xberg@xberg-io

    具 Rust 核心的多语言文档智能框架。从 101 种格式(115 种文件扩展名)提取文本、元数据、图像和结构化数据,并支持 371 种代码语言的代码智能。提供 15 种语言绑定 — Rust、Python、Ruby、Java、Go、PHP、Elixir、C#、TypeScript — 以及 CLI、REST API 与 MCP 服务器

    9,254+21近 7 天星标变化
  • unstract@Zipstack

    LLM 驱动的非结构化数据抽取 — 为 API 部署与 ETL 工作流设计

    7,191+9近 7 天星标变化
  • TurboOCR@aiptimizer

    TurboOCR,>200 img/s OmnidocBench。TensorRT FP16、PP-OCRv6、HTTP + gRPC

    1,059+20近 7 天星标变化
  • signaturepdf@24eme

    免费开源的网页软件,可用于签署 PDF(单独或与他人合作)、整理页面、编辑元数据以及压缩 PDF

    828+2近 7 天星标变化
  • pytr@pytr-org

    在终端机中使用 TradeRepublic 并批量下载所有文档

    794+6近 7 天星标变化
  • mupdf.js@ArtifexSoftware

    MuPDF 的 JavaScript 绑定

    608+2近 7 天星标变化
  • ExtractPDF4J@ExtractPDF4J

    Java PDF 表格提取与 OCR 库。通过流、网格(OpenCV 风格网格检测)与混合解析,从文本型与扫描 PDF 中提取结构化表格。

    521+0近 7 天星标变化
← 返回主题列表