跳到主要內容
buildradar
Sign in
主題 · ocr

ocr

標記 ocr 主題、收錄中的開源專案,依星數排序。

共 186 個專案
  • deepdoctection@deepdoctection

    一個用於 Document AI 的倉庫

    3,257+9近 7 天星數變化
  • Pix2Text@breezedeus

    一款使用輕量模型的開源 Python3 工具,用於識別圖片中的版面配置、表格、數學公式 (LaTeX) 和文字,並將其轉換為 Markdown 格式。這是 Mathpix 的免費替代方案,可將視覺內容無縫轉換為文字表示。支援 80 多種語言。

    3,229+3近 7 天星數變化
  • captcha_trainer@kerlomz

    [验证码识别-训练] 本项目基于 CNN/ResNet/DenseNet+GRU/LSTM+CTC/CrossEntropy 实现验证码识别,仅用于训练模型。

    3,213+0近 7 天星數變化
  • text-extract-api@CatchTheTornado

    使用最先進的現代 OCR 與 Ollama 支援模型的檔案(PDF、Word、PPTX...)擷取與解析 API。將檔案匿名化、移除個人識別資訊(PII),並將任何檔案或圖片轉換為結構化的 JSON 或 Markdown。

    3,177+0近 7 天星數變化
  • gosseract@otiai10

    使用 Tesseract C++ 库的 OCR(光學字符識別)Go 包

    3,134+2近 7 天星數變化
  • tools-ocr@AnyListen

    树洞 OCR 文字识别(一款跨平台的 OCR 小工具)

    3,065+1近 7 天星數變化
  • tesseract-ocr-for-php@thiagoalessio

    在 PHP 中使用 Tesseract OCR 的包裝器。

    3,039-2近 7 天星數變化
  • 一個精選的實用 AI 專案集合,實現 OCR 系統、RAG、AI 代理和其他 AI 用例

    3,030+58近 7 天星數變化
  • llm_aided_ocr@Dicklesworthstone

    使用 LLMs(本地或 API)增強 Tesseract OCR 輸出,用於掃描 PDF 的錯誤修正、智慧分塊和 Markdown 格式化

    2,996+3近 7 天星數變化
  • markdownify-mcp@zcaceres

    將幾乎任何東西轉換為 Markdown 的模型上下文協議服務器

    2,983-1近 7 天星數變化
  • CHINESE-OCR@xiaofengShi

    使用 CTPN、CRNN 和 CTC 進行端到端的中文場景文字檢測與識別(舊版專案)。

    2,955+0近 7 天星數變化
  • openrecall@openrecall

    OpenRecall 是一個完全開源、以隱私為首要考量的替代方案,取代像 Microsoft Windows Recall 這類專有解決方案。使用 OpenRecall,您可以輕鬆存取數位歷史,提升記憶與生產力,同時不會妥協隱私。

    2,937+2近 7 天星數變化
  • papermerge@ciur

    數位檔案掃描文件的開源文件管理系統

    2,935+1近 7 天星數變化
  • comic-translate@ogkalu2

    AI 漫畫翻譯應用程式/瀏覽器擴充功能,用於自動翻譯多種語言和格式(圖片、PDF、EPUB、CBR、CBZ 等)的漫畫(comics、manga、manhwa、BDs、fumetti 等)。

    2,928+12近 7 天星數變化
  • manga-ocr@kha-white

    針對日文文字的光學字元辨識,主要聚焦於日本漫畫

    2,770+7近 7 天星數變化
  • 基於 manga-image-translator 的開源漫畫翻譯工具。支援日、韓、美漫自動翻譯,內建 OpenAI、Gemini 等 5 種翻譯引擎,並提供視覺化編輯器自由調整文字樣式。一鍵安裝,開箱即用。如果喜歡,歡迎點亮 ⭐ Star 支援!

    2,711+35近 7 天星數變化
  • normcap@dynobo

    基於 OCR 的螢幕截圖工具,用於擷取資訊而非僅僅是圖片

    2,705+4近 7 天星數變化
  • 使用 LLM 和 LLM Vision (OCR) 來處理 paperless-ngx - 由 AI 驅動的檔案數位化

    2,662+8近 7 天星數變化
  • docs@sismics

    具備大型昂貴解決方案所期望所有功能的輕量級文件管理系統

    2,561+0近 7 天星數變化
  • ballerine@ballerine-io

    用於風險決策的開源基礎設施與資料編排平台

    2,427+1近 7 天星數變化
  • ade-cli@landing-ai

    LandingAI 的 Agentic Document Extraction (ADE) 官方 CLI——從終端機解析文件並萃取符合結構描述的資料

    2,410+1近 7 天星數變化
  • comfyui_LLM_party@heshengtao

    ComfyUI 中的 LLM Agent 框架,包含 MCP server、Omost、GPT-sovits、ChatTTS、GOT-OCR2.0 與 FLUX prompt 節點,支援存取飛書、Discord,並適配所有具備類似 OpenAI / aisuite 介面的 LLM,例如 o1、ollama、gemini、grok、qwen、GLM、deepseek、kimi、doubao。已適配本地 LLM、VLM、GGUF(如 llama-3.3 Janus-Pro、Linkage graphRAG)

    2,348+5近 7 天星數變化
  • docspell@eikek

    協助整理來自掃描器、電子郵件和其他來源的文件堆,只需花費極少的心力。

    2,317+2近 7 天星數變化
  • gowall@Achno

    一款用於轉換桌布配色方案/調色盤的工具,支援基於 VLM 的傳統與混合 OCR、圖片壓縮、調色盤擷取、利用對抗網路進行圖片超高解析度放大等更多影像處理功能。

    2,303+1近 7 天星數變化
  • retain-pdf@wxyhgk

    在保留版面、公式與結構的前提下進行 PDF 翻譯,適用於科研與技術文件

    2,234+8近 7 天星數變化
  • deepseek-ocr.rs@TimmyOVO

    Rust 多後端 OCR/VLM 引擎(支援 DeepSeek‑OCR-1/2、PaddleOCR‑VL、DotsOCR),具備 DSQ 量化與相容 OpenAI 的伺服器與 CLI —— 無需 Python 即可在地端執行。

    2,184+1近 7 天星數變化
  • SimpleHTR@githubharald

    使用 TensorFlow 實作的手寫文字辨識(HTR)系統。

    2,184+0近 7 天星數變化
  • tesserocr@sirfz

    tesseract-ocr API 的 Python 包裝函式庫

    2,171+0近 7 天星數變化
  • obsidian-omnisearch@scambier

    一個為 Obsidian 設計、能「直接運作」的搜尋引擎。支援 OCR 與 PDF 索引。

    2,131+2近 7 天星數變化
  • docext@NanoNets

    本地部署、無需 OCR 的非結構化資料萃取、Markdown 轉換與基準測試工具包。(https://idp-leaderboard.org/)

    2,086-1近 7 天星數變化
← 返回主題列表