CatchTheTornado/text-extract-api
@CatchTheTornado使用最先進的現代 OCR 與 Ollama 支援模型的檔案(PDF、Word、PPTX...)擷取與解析 API。將檔案匿名化、移除個人識別資訊(PII),並將任何檔案或圖片轉換為結構化的 JSON 或 Markdown。
星數
3,177
Fork 數
279
語言
Python
授權
MIT
最後推送
9 個月前
相關情報(0)
還沒有相關情報
radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。