Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · document-analysis

document-analysis

Các kho mã nguồn mở đang theo dõi được gắn thẻ document-analysis, sắp xếp theo số sao.

Kho mã
12
Tổng số sao
103.717
Số sao trung bình
8.643
Tỷ trọng
0,01%

Những chủ đề thường xuất hiện cùng document-analysis trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ document-analysis.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • MinerU@opendatalab

    Biến các tài liệu phức tạp như PDF và tài liệu Office thành định dạng markdown/JSON sẵn sàng cho LLM phục vụ cho quy trình làm việc Agentic của bạn.

    78.747+564Thay đổi số sao trong 7 ngày qua
  • Dolphin@bytedance

    Kho lưu trữ chính thức cho “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.

    9.049-1Thay đổi số sao trong 7 ngày qua
  • docetl@ucbepic

    Một hệ thống xử lý dữ liệu và ETL chạy bằng LLM mang tính tác vụ (agentic)

    4.040+54Thay đổi số sao trong 7 ngày qua
  • PdfPig@UglyToad

    Đọc và trích xuất văn bản cùng nội dung khác từ PDF trong C# (bản chuyển đổi từ PDFBox)

    2.552+5Thay đổi số sao trong 7 ngày qua
  • docext@NanoNets

    Bộ công cụ trích xuất dữ liệu phi cấu trúc tại chỗ không cần OCR, chuyển đổi markdown và đánh giá chuẩn.

    2.086+4Thay đổi số sao trong 7 ngày qua
  • AdvancedLiterateMachinery@AlibabaResearch

    Bộ sưu tập các ý tưởng và thuật toán độc đáo, sáng tạo hướng tới Máy móc văn bản nâng cao. Dự án này được duy trì bởi Nhóm OCR thuộc Phòng thí nghiệm Công nghệ Ngôn ngữ, Phòng thí nghiệm Thông Y, Alibaba Group.

    1.834-1Thay đổi số sao trong 7 ngày qua
  • documind@DocumindHQ

    Nền tảng mã nguồn mở để trích xuất dữ liệu có cấu trúc từ tài liệu sử dụng AI.

    1.520-1Thay đổi số sao trong 7 ngày qua
  • OpenOCR@Topdu

    OpenOCR: Bộ công cụ mã nguồn mở dành cho nghiên cứu và ứng dụng OCR tổng quát, tích hợp chuẩn mực huấn luyện và đánh giá thống nhất, hệ thống OCR và phân tích tài liệu cấp thương mại, cùng các bản cài đặt lại chính xác từ nhiều bài báo học thuật khác nhau.

    1.440+3Thay đổi số sao trong 7 ngày qua
  • dedoc@ispras

    Dedoc là một thư viện (dịch vụ) để tự động hóa việc phân tích cú pháp tài liệu và đưa về định dạng thống nhất. Nó tự động trích xuất nội dung, cấu trúc logic, bảng biểu và thông tin meta từ các tài liệu điện tử văn bản.

    732+13Thay đổi số sao trong 7 ngày qua
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] Một khung làm việc dựa trên diffusion cho OCR tài liệu, thay thế giải mã tự hồi quy bằng giải mã diffusion song song cấp khối.

    615+1Thay đổi số sao trong 7 ngày qua
  • PICK-pytorch@wenwenyu

    Mã nguồn cho bài báo "PICK: Trích xuất thông tin khóa từ tài liệu sử dụng mạng học đồ thị - tích chập cải tiến" (ICPR 2020).

    570+0Thay đổi số sao trong 7 ngày qua
  • assemblyline@CybercentreCanada

    AssemblyLine 4: Phân loại tệp và phân tích phần mềm độc hại.

    531+3Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề