跳到主要內容
buildradar
登入

CatchTheTornado/text-extract-api

@CatchTheTornado

使用最先進的現代 OCR 與 Ollama 支援模型的檔案(PDF、Word、PPTX...)擷取與解析 API。將檔案匿名化、移除個人識別資訊(PII),並將任何檔案或圖片轉換為結構化的 JSON 或 Markdown。

星數
3,177
Fork 數
279
語言
Python
授權
MIT
最後推送
9 個月前
Pythonjsonpdfllmapipiiextractanonymizationocrocr-python

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。