メインコンテンツへスキップ
buildradar
Sign in

CatchTheTornado/text-extract-api

@CatchTheTornado

最新のOCRとOllama対応モデルを使用した、ドキュメント(PDF、Word、PPTXなど)の抽出・解析API。ドキュメントの匿名化、PIIの削除、あらゆるドキュメントや画像の構造化JSONまたはMarkdownへの変換。

スター
3,177
フォーク
279
言語
Python
ライセンス
MIT
最終プッシュ
9 か月前
Pythonjsonpdfllmapipiiextractanonymizationocrocr-python

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。