CatchTheTornado/text-extract-api
@CatchTheTornadoAPI trích xuất và phân tích tài liệu (PDF, Word, PPTX ...) sử dụng OCR hiện đại tiên tiến + các mô hình được hỗ trợ bởi Ollama. Ẩn danh hóa tài liệu. Loại bỏ PII. Chuyển đổi bất kỳ tài liệu hoặc hình ảnh nào thành JSON hoặc Markdown có cấu trúc
Sao
3.177
Fork
279
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
9 tháng trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.