본문으로 건너뛰기
buildradar
Sign in
토픽 · document-analysis

document-analysis

document-analysis 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
12
총 스타
103,717
평균 스타
8,643
비중
0.01%

같은 리포지토리에 document-analysis 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 document-analysis 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • MinerU@opendatalab

    에이전틱 워크플로우를 위해 PDF 및 Office 문서 같은 복잡한 문서를 LLM에 적합한 markdown/JSON으로 변환합니다.

    78,747+564최근 7일 스타 변화
  • Dolphin@bytedance

    ACL 2025에 채택된 “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting” 공식 저장소

    9,049-1최근 7일 스타 변화
  • docetl@ucbepic

    에이전트 기반 LLM 데이터 처리 및 ETL 시스템

    4,040+54최근 7일 스타 변화
  • PdfPig@UglyToad

    C#에서 PDF의 텍스트 및 기타 콘텐츠 읽기 및 추출 (PDFBox 포팅)

    2,552+5최근 7일 스타 변화
  • docext@NanoNets

    온프레미스 OCR 프리 비정형 데이터 추출, 마크다운 변환 및 벤치마킹 툴킷 (https://idp-leaderboard.org/)

    2,086+4최근 7일 스타 변화
  • AdvancedLiterateMachinery@AlibabaResearch

    고급 리터러트 머시너리(Advanced Literate Machinery)를 위한 독창적이고 혁신적인 아이디어 및 알고리즘 모음입니다. 이 프로젝트는 Alibaba Group Tongyi Lab Language Technology Lab의 OCR 팀에서 유지 관리합니다.

    1,834-1최근 7일 스타 변화
  • documind@DocumindHQ

    AI를 사용하여 문서에서 구조화된 데이터를 추출하는 오픈소스 플랫폼

    1,520-1최근 7일 스타 변화
  • OpenOCR@Topdu

    OpenOCR: 일반 OCR 연구 및 응용을 위한 오픈소스 툴킷으로, 통합 학습 및 평가 벤치마크, 상용급 OCR 및 문서 파싱 시스템, 그리고 다양한 학술 논문의 핵심 구현에 대한 충실한 재현을 통합합니다.

    1,440+3최근 7일 스타 변화
  • dedoc@ispras

    Dedoc은 텍스트 전자 문서의 파싱을 자동화하고 단일 포맷으로 변환하는 라이브러리(서비스)입니다. 문서에서 콘텐츠, 논리적 구조, 표, 메타 정보를 자동으로 추출합니다.

    732+13최근 7일 스타 변화
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] 자기회귀 디코딩을 블록 단위 병렬 확산 디코딩으로 대체하는 문서 OCR용 확산 기반 프레임워크

    615+1최근 7일 스타 변화
  • PICK-pytorch@wenwenyu

    PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks (ICPR 2020) 논문 코드

    570+0최근 7일 스타 변화
  • assemblyline@CybercentreCanada

    AssemblyLine 4: 파일 분류 및 악성코드 분석

    532+3최근 7일 스타 변화
← 토픽 목록으로