본문으로 건너뛰기
buildradar
Sign in
토픽 · pdf-extraction

pdf-extraction

pdf-extraction 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
9
총 스타
67,687
평균 스타
7,521
비중
0.00%

같은 리포지토리에 pdf-extraction 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 pdf-extraction 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • opendataloader-pdf@opendataloader-project

    AI 학습용 데이터를 위한 PDF 파서. PDF 접근성 자동화. 오픈소스.

    28,905+86최근 7일 스타 변화
  • pdf-inspector@firecrawl

    PDF 검사, 분류 및 텍스트 추출을 위한 빠른 Rust 라이브러리. 스캔본과 텍스트 기반 PDF를 지능적으로 감지하여 스마트 라우팅 결정을 내립니다.

    18,547+1,782최근 7일 스타 변화
  • xberg@xberg-io

    Rust 코어로 구동되는 다중 언어 문서 지능형 프레임워크. 101개 형식(115개 파일 확장자)에서 텍스트, 메타데이터, 이미지, 구조화된 데이터를 추출하고 371개 프로그래밍 언어에 대한 코드 분석을 지원합니다. Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript 등 15개 언어 바인딩과 CLI, REST API, MCP 서버를 제공합니다.

    9,254+31최근 7일 스타 변화
  • unstract@Zipstack

    LLM 기반 비정조화 데이터 추출 - API 배포 및 ETL 파이프라인 워크플로우를 위해 구축됨

    7,191+19최근 7일 스타 변화
  • TurboOCR@aiptimizer

    TurboOCR, OmnidocBench에서 초당 200장 이상 이미지 처리. TensorRT FP16, PP-OCRv6, HTTP 및 gRPC 지원

    1,054+20최근 7일 스타 변화
  • signaturepdf@24eme

    PDF 서명(단독 또는 공동), 페이지 정리, 메타데이터 편집, PDF 압축을 위한 무료 오픈소스 웹 소프트웨어

    827+0최근 7일 스타 변화
  • pytr@pytr-org

    터미널에서 TradeRepublic을 사용하고 모든 문서를 일괄 다운로드

    793+3최근 7일 스타 변화
  • mupdf.js@ArtifexSoftware

    MuPDF를 위한 JavaScript 바인딩

    608+1최근 7일 스타 변화
  • ExtractPDF4J@ExtractPDF4J

    Java PDF 표 추출 및 OCR 라이브러리. 스트림, 격자(OpenCV 스타일 그리드 감지) 및 하이브리드 파싱을 사용하여 텍스트 기반 및 스캔된 PDF에서 구조화된 표를 추출합니다.

    520-10최근 7일 스타 변화
← 토픽 목록으로