Chuyển tới nội dung chính
buildradar
Sign in

CatchTheTornado/text-extract-api

@CatchTheTornado

API trích xuất và phân tích tài liệu (PDF, Word, PPTX ...) sử dụng OCR hiện đại tiên tiến + các mô hình được hỗ trợ bởi Ollama. Ẩn danh hóa tài liệu. Loại bỏ PII. Chuyển đổi bất kỳ tài liệu hoặc hình ảnh nào thành JSON hoặc Markdown có cấu trúc

Sao
3.177
Fork
279
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
9 tháng trước
Pythonjsonpdfllmapipiiextractanonymizationocrocr-python

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.