pdf-extraction
pdf-extraction 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 pdf-extraction 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 pdf-extraction 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1
AI 학습용 데이터를 위한 PDF 파서. PDF 접근성 자동화. 오픈소스.
★ 28,905+86최근 7일 스타 변화 - #2
PDF 검사, 분류 및 텍스트 추출을 위한 빠른 Rust 라이브러리. 스캔본과 텍스트 기반 PDF를 지능적으로 감지하여 스마트 라우팅 결정을 내립니다.
★ 18,547+1,782최근 7일 스타 변화 - #3
Rust 코어로 구동되는 다중 언어 문서 지능형 프레임워크. 101개 형식(115개 파일 확장자)에서 텍스트, 메타데이터, 이미지, 구조화된 데이터를 추출하고 371개 프로그래밍 언어에 대한 코드 분석을 지원합니다. Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript 등 15개 언어 바인딩과 CLI, REST API, MCP 서버를 제공합니다.
★ 9,254+31최근 7일 스타 변화 - #4★ 7,191+19최근 7일 스타 변화
- #5
TurboOCR, OmnidocBench에서 초당 200장 이상 이미지 처리. TensorRT FP16, PP-OCRv6, HTTP 및 gRPC 지원
★ 1,054+20최근 7일 스타 변화 - #6
PDF 서명(단독 또는 공동), 페이지 정리, 메타데이터 편집, PDF 압축을 위한 무료 오픈소스 웹 소프트웨어
★ 827+0최근 7일 스타 변화 - #7★ 793+3최근 7일 스타 변화
- #8★ 608+1최근 7일 스타 변화
- #9
Java PDF 표 추출 및 OCR 라이브러리. 스트림, 격자(OpenCV 스타일 그리드 감지) 및 하이브리드 파싱을 사용하여 텍스트 기반 및 스캔된 PDF에서 구조화된 표를 추출합니다.
★ 520-10최근 7일 스타 변화