document-processing
document-processing 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 document-processing 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 document-processing 태그가 달린 리포지토리예요.
- #1
기술 도서 PDF를 Claude Code 스킬로 변환하여 작업 중에 학습하고, 참고하고, 사용할 수 있습니다.
★ 27,016+3,296최근 7일 스타 변화 - #2★ 12,196+46최근 7일 스타 변화
- #3
AI 기반 오피스 어시스턴트 및 생산성 워크플로우 구축을 위한 모듈식 SenseNova 스킬
★ 5,173+247최근 7일 스타 변화 - #4★ 4,040+54최근 7일 스타 변화
- #5
레이아웃, 수식, 구조를 유지한 상태로 PDF 번역, 과학 연구 및 기술 문서에 적합
★ 2,225+20최근 7일 스타 변화 - #6
ExtractThinker는 LLM을 위한 문서 지능(Document Intelligence) 라이브러리로, 유연하고 강력한 문서 워크플로우를 위해 ORM 스타일의 상호작용을 제공합니다.
★ 1,595+2최근 7일 스타 변화 - #7
OpenOCR: 일반 OCR 연구 및 응용을 위한 오픈소스 툴킷으로, 통합 학습 및 평가 벤치마크, 상용급 OCR 및 문서 파싱 시스템, 그리고 다양한 학술 논문의 핵심 구현에 대한 충실한 재현을 통합합니다.
★ 1,440+3최근 7일 스타 변화 - #8
Python 및 Rust를 위한 가장 빠른 PDF 라이브러리. 텍스트 추출, 이미지 추출, 마크다운 변환, PDF 생성 및 편집 지원. 평균 0.8ms, 업계 선두 대비 5배 빠름, 3,830개 PDF 테스트 100% 통과. MIT/Apache-2.0 라이선스.
★ 1,006+37최근 7일 스타 변화 - #9
데이터를 위한 로컬 퍼스트, 오픈소스 AI 어시스턴트. 작업, 메모, 문서, 사진, 북마크를 통합합니다. 프라이빗하며, 자체 호스팅이 가능하고 API를 통해 확장할 수 있습니다.
★ 916+15최근 7일 스타 변화 - #10
MCP를 통해 AI 에이전트에 PDF를 볼 수 있는 시각 제공 — 구조화된 텍스트, 표, OCR, 시각적 증거 및 페이지 수준 인용. Rust 네이티브, 로컬 퍼스트.
★ 906+8최근 7일 스타 변화 - #11
비정형 문서를 검증되고 풍부하며 쿼리 가능한 지식 그래프로 변환합니다.
★ 845+91최근 7일 스타 변화 - #12★ 704+49최근 7일 스타 변화
- #13
Java PDF 표 추출 및 OCR 라이브러리. 스트림, 격자(OpenCV 스타일 그리드 감지) 및 하이브리드 파싱을 사용하여 텍스트 기반 및 스캔된 PDF에서 구조화된 표를 추출합니다.
★ 517-27최근 7일 스타 변화