跳到主要內容
buildradar
Sign in
主題 · document-parsing

document-parsing

標記 document-parsing 主題、收錄中的開源專案,依星數排序。

專案數
13
總星數
212,871
平均星數
16,375
佔比
0.01%

常跟 document-parsing 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 document-parsing 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • PaddleOCR@PaddlePaddle

    將 PDF 或影像文件轉換為 AI 可用的結構化資料。輕量且功能強大的 OCR 工具套件,橋接影像/PDF 與 LLM,支援超過 100 種語言。

    88,730+276近 7 天星數變化
  • docling@docling-project

    讓你的文件為生成式 AI 做好準備

    65,908+182近 7 天星數變化
  • opendataloader-pdf@opendataloader-project

    PDF 解析器,將資料轉為 AI 可用格式。自動化 PDF 可及性。開源。

    28,905+49近 7 天星數變化
  • unstructured@Unstructured-IO

    將文件輕鬆轉換為結構化資料。Unstructured 是開源 ETL 解決方案,可將複雜文件轉換為乾淨的結構化格式供語言模型使用。訪問我們網站了解企業級平台產品,支援生產級工作流、分割、增強、切塊與嵌入。

    15,381+19近 7 天星數變化
  • llama_cloud_services@run-llama

    雲端中的知識代理與管理

    4,264+2近 7 天星數變化
  • ade-cli@landing-ai

    LandingAI 的 Agentic Document Extraction (ADE) 官方 CLI——從終端機解析文件並萃取符合結構描述的資料

    2,410+1近 7 天星數變化
  • ExtractThinker@enoch3712

    ExtractThinker 是一個針對 LLM 的文件智慧函式庫,提供 ORM 風格的互動以實現靈活且強大的文件工作流程。

    1,596+1近 7 天星數變化
  • docstrange@NanoNets

    透過智慧結構化資料提取與先進 OCR 技術,從任何文件、圖片、PDF、Word 文件、PPT 或網址中提取並將資料轉換為多種格式(Markdown、JSON、CSV、HTML)。

    1,534+1近 7 天星數變化
  • OpenOCR@Topdu

    OpenOCR:一個用於通用 OCR 研究與應用的開源工具包,整合了統一的訓練與評估基準、商業級 OCR 與文件解析系統,以及對多篇學術論文核心實作的忠實重現。

    1,441+2近 7 天星數變化
  • TurboOCR@aiptimizer

    TurboOCR,>200 img/s OmnidocBench。TensorRT FP16、PP-OCRv6、HTTP + gRPC

    1,059+17近 7 天星數變化
  • haiku.rag@ggozad

    用於本地與自託管文件搜尋的 Agentic RAG:基於嵌入式 LanceDB 的混合檢索、重排序與多模態 RAG,並整合 Docling 解析與 MCP 伺服器

    598+12近 7 天星數變化
  • ParseBench@run-llama

    ParseBench - 用於 AI Agent 的文件解析基準測試。

    565+12近 7 天星數變化
  • NexusRAG@LeDat98

    Hybrid RAG system combining vector search, knowledge graph (LightRAG), and cross-encoder reranking — with Docling document parsing, visual intelligence (image/table captioning), agentic streaming chat, and inline citations. Powered by Gemini or local Ollama models.

    517+10近 7 天星數變化
← 返回主題列表