メインコンテンツへスキップ
buildradar
Sign in
トピック · ocr

ocr

ocr がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

186 件のリポジトリ
  • deepdoctection@deepdoctection

    Document AIのためのリポジトリ

    3,257+9直近 7 日のスター増減
  • Pix2Text@breezedeus

    画像内のレイアウト、表、数式 (LaTeX)、テキストを認識して Markdown 形式に変換するための、小型モデルを使用したオープンソースの Python3 ツール。Mathpix の無料の代替手段であり、視覚的コンテンツからテキストベース表現へのシームレスな変換を実現します。80 以上の言語をサポートしています。

    3,229+3直近 7 日のスター増減
  • captcha_trainer@kerlomz

    [認証コード認識-訓練] CNN/ResNet/DenseNet+GRU/LSTM+CTC/CrossEntropyを使用して認証コード認識を実現するプロジェクト。モデルの訓練のみを目的としています。

    3,213+0直近 7 日のスター増減
  • text-extract-api@CatchTheTornado

    最新のOCRとOllama対応モデルを使用した、ドキュメント(PDF、Word、PPTXなど)の抽出・解析API。ドキュメントの匿名化、PIIの削除、あらゆるドキュメントや画像の構造化JSONまたはMarkdownへの変換。

    3,177+0直近 7 日のスター増減
  • gosseract@otiai10

    Tesseract C++ライブラリを使用した、OCR(光学文字認識)用のGoパッケージ

    3,134+2直近 7 日のスター増減
  • tools-ocr@AnyListen

    ツリーホール OCR テキスト認識(クロスプラットフォームの OCR 小型ツール)

    3,065+1直近 7 日のスター増減
  • tesseract-ocr-for-php@thiagoalessio

    PHP内でTesseract OCRを扱うためのラッパー。

    3,039-2直近 7 日のスター増減
  • OCRシステム、RAG、AIエージェントなどの実践的なAIプロジェクトを集めた厳選コレクション。

    3,030+58直近 7 日のスター増減
  • llm_aided_ocr@Dicklesworthstone

    LLM(ローカルまたはAPI)を使用してTesseract OCRの出力を改善し、スキャンされたPDFのエラー修正、スマートなチャンキング、Markdownフォーマットを行います

    2,996+3直近 7 日のスター増減
  • markdownify-mcp@zcaceres

    ほぼあらゆるものを Markdown に変換する Model Context Protocol サーバー

    2,983-1直近 7 日のスター増減
  • CHINESE-OCR@xiaofengShi

    CTPN、CRNN、CTC を使用したエンドツーエンドの中国語シーンテキスト検出および認識(レガシープロジェクト)。

    2,955+0直近 7 日のスター増減
  • openrecall@openrecall

    OpenRecallは、MicrosoftのWindows Recallのようなプロプライエタリなソリューションに代わる、完全にオープンソースでプライバシーファーストな代替ツールです。OpenRecallを使用すると、デジタル履歴に簡単にアクセスでき、プライバシーを損なうことなく記憶と生産性を向上させることができます。

    2,937+2直近 7 日のスター増減
  • papermerge@ciur

    デジタルアーカイブ(スキャン済み文書)向けのオープンソース文書管理システム

    2,935+1直近 7 日のスター増減
  • comic-translate@ogkalu2

    AIを活用したコミック・マンガの翻訳アプリおよびブラウザ拡張機能。アメコミ、マンガ、Webtoon、バンドデシネなど多様な形式(画像、PDF、EPUB、CBR、CBZ等)のコンテンツを複数言語で自動翻訳します。

    2,928+12直近 7 日のスター増減
  • manga-ocr@kha-white

    日本語テキスト(主に日本のマンガ)を対象とした光学文字認識(OCR)ツール。

    2,770+7直近 7 日のスター増減
  • manga-image-translator をベースにしたオープンソースのマンガ翻訳ツール。日、韓、米のマンガの自動翻訳をサポートし、OpenAI や Gemini など 5 種類の翻訳エンジンを内蔵。テキストスタイルの自由な調整が可能なビジュアルエディタを提供。ワンクリックでインストールでき、すぐに使用可能。気に入っていただけたら、ぜひ ⭐ Star でサポートしてください!

    2,711+35直近 7 日のスター増減
  • normcap@dynobo

    画像ではなく情報としてキャプチャする、OCR 搭載画面キャプチャツール

    2,705+4直近 7 日のスター増減
  • LLM と LLM Vision (OCR) を使用して paperless-ngx を処理 - AI によるドキュメントのデジタル化

    2,662+8直近 7 日のスター増減
  • docs@sismics

    高価な大型ソリューションに期待されるすべての機能を備えた、軽量なドキュメント管理システム

    2,561+0直近 7 日のスター増減
  • ballerine@ballerine-io

    リスク決定のためのオープンソースインフラストラクチャおよびデータオーケストレーションプラットフォーム

    2,427+1直近 7 日のスター増減
  • ade-cli@landing-ai

    LandingAI による Agentic Document Extraction (ADE) の公式 CLI — ターミナルからドキュメントを解析し、スキーマに沿ったデータを抽出する

    2,410+1直近 7 日のスター増減
  • comfyui_LLM_party@heshengtao

    ComfyUI 向けの LLM Agent フレームワーク。MCP サーバー、Omost、GPT-sovits、ChatTTS、GOT-OCR2.0、FLUX プロンプトノードを含み、Feishu や Discord にアクセス可能。o1、ollama、gemini、grok、qwen、GLM、deepseek、kimi、doubao など、OpenAI / aisuite 互換インターフェースを持つすべての LLM に対応。llama-3.3 Janus-Pro や Linkage graphRAG などのローカル LLM、VLM、GGUF にも対応。

    2,348+5直近 7 日のスター増減
  • docspell@eikek

    スキャナーやメールなどからの膨大なドキュメントを最小限の手間で整理するのを支援します

    2,317+2直近 7 日のスター増減
  • gowall@Achno

    壁紙の色スキーム/パレット変換、VLMによる従来型およびハイブリッドOCR、画像圧縮、カラーパレット抽出、敵対的ネットワークを用いた画像アップスケーリングなどの画像処理機能を提供するツール

    2,303+1直近 7 日のスター増減
  • retain-pdf@wxyhgk

    レイアウト、数式、構造を保持したままPDFを翻訳。科学研究や技術文書に最適。

    2,234+8直近 7 日のスター増減
  • SimpleHTR@githubharald

    TensorFlowで実装された手書き文字認識(HTR)システム。

    2,184+0直近 7 日のスター増減
  • deepseek-ocr.rs@TimmyOVO

    Rust 製のマルチバックエンド OCR/VLM エンジン(DeepSeek‑OCR-1/2、PaddleOCR‑VL、DotsOCR)。DSQ量子化、OpenAI互換サーバー、CLIを備え、Pythonなしでローカル実行可能。

    2,184+1直近 7 日のスター増減
  • tesserocr@sirfz

    tesseract-ocr API 用の Python ラッパー

    2,171+0直近 7 日のスター増減
  • obsidian-omnisearch@scambier

    Obsidian向けに「そのまま使える」検索エンジン。OCRおよびPDFのインデックス作成をサポート。

    2,131+2直近 7 日のスター増減
  • docext@NanoNets

    オンプレミスで OCR 不要の非構造化データ抽出、マークダウン変換、ベンチマーク用のツールキット (https://idp-leaderboard.org/)

    2,086-1直近 7 日のスター増減
← トピック一覧に戻る