跳到主要内容
buildradar
Sign in
主题 · ocr

ocr

标记 ocr 主题、收录中的开源项目,按星标数排序。

共 186 个项目
  • deepdoctection@deepdoctection

    一个用于 Document AI 的仓库

    3,257+0近 7 天星标变化
  • Pix2Text@breezedeus

    一款使用轻量模型的开源 Python3 工具,用于识别图片中的版面布局、表格、数学公式 (LaTeX) 和文本,并将其转换为 Markdown 格式。这是 Mathpix 的免费替代方案,可将视觉内容无缝转换为文本表示。支持 80 多种语言。

    3,229+0近 7 天星标变化
  • captcha_trainer@kerlomz

    [验证码识别-训练] 本项目基于 CNN/ResNet/DenseNet+GRU/LSTM+CTC/CrossEntropy 实现验证码识别,仅用于训练模型。

    3,213+0近 7 天星标变化
  • text-extract-api@CatchTheTornado

    使用最先进的现代 OCR 与 Ollama 支持文档(PDF、Word、PPTX...)提取与解析 API。将文档匿名化、移除个人身份信息(PII),并将任何文档或图片转换为结构化的 JSON 或 Markdown。

    3,177+0近 7 天星标变化
  • gosseract@otiai10

    使用 Tesseract C++ 库的 OCR(光学字符识别)Go 包

    3,134+0近 7 天星标变化
  • tools-ocr@AnyListen

    树洞 OCR 文字识别(一款跨平台的 OCR 小工具)

    3,065+0近 7 天星标变化
  • tesseract-ocr-for-php@thiagoalessio

    在 PHP 中使用 Tesseract OCR 的包装器。

    3,039+0近 7 天星标变化
  • 一个精选的实用 AI 项目集合,实现 OCR 系统、RAG、AI 代理和其他 AI 用例

    3,030+0近 7 天星标变化
  • llm_aided_ocr@Dicklesworthstone

    使用 LLMs(本地或 API)增强 Tesseract OCR 输出,用于扫描 PDF 的错误修正、智能分块和 Markdown 格式化

    2,996+0近 7 天星标变化
  • markdownify-mcp@zcaceres

    将几乎任何东西转换为 Markdown 的模型上下文协议服务器

    2,983+0近 7 天星标变化
  • CHINESE-OCR@xiaofengShi

    使用 CTPN、CRNN 和 CTC 进行端到端的中文场景文字检测与识别(旧版项目)。

    2,955+0近 7 天星标变化
  • openrecall@openrecall

    OpenRecall 是一个完全开源、以隐私为首要考虑的替代方案,取代像 Microsoft Windows Recall 这类专有解决方案。使用 OpenRecall,您可以轻松存取数字历史,提升记忆与生产力,同时不会妥协隐私。

    2,937+0近 7 天星标变化
  • papermerge@ciur

    数字档案扫描文件的开源文件管理系统

    2,935+0近 7 天星标变化
  • comic-translate@ogkalu2

    AI 漫画翻译应用/浏览器扩展,用于自动翻译多种语言和格式(图片、PDF、EPUB、CBR、CBZ 等)的漫画(comics、manga、manhwa、BDs、fumetti 等)。

    2,928+0近 7 天星标变化
  • manga-ocr@kha-white

    针对日文文本的光学字符识别,主要聚焦于日本漫画

    2,770+0近 7 天星标变化
  • 基于 manga-image-translator 的开源漫画翻译工具。支持日、韩、美漫自动翻译,内置 OpenAI、Gemini 等 5 种翻译引擎,并提供可视化编辑器自由调整文本样式。一键安装,开箱即用。如果喜欢,欢迎点亮 ⭐ Star 支持!

    2,711+0近 7 天星标变化
  • normcap@dynobo

    基于 OCR 的屏幕截图工具,用于获取信息而非仅仅是图片

    2,705+0近 7 天星标变化
  • 使用 LLM 和 LLM Vision (OCR) 来处理 paperless-ngx - 由 AI 驱动的文档数字化

    2,662+0近 7 天星标变化
  • docs@sismics

    具备大型昂贵解决方案所期望所有功能的轻量级文档管理系统

    2,561+0近 7 天星标变化
  • ballerine@ballerine-io

    用于风险决策的开源基础设施与数据编排平台

    2,427+0近 7 天星标变化
  • ade-cli@landing-ai

    LandingAI 的 Agentic Document Extraction (ADE) 官方 CLI——从终端解析文档并提取符合架构的数据

    2,410+0近 7 天星标变化
  • comfyui_LLM_party@heshengtao

    ComfyUI 中的 LLM Agent 框架,包含 MCP server、Omost、GPT-sovits、ChatTTS、GOT-OCR2.0 与 FLUX prompt 节点,支持访问飞书、Discord,并适配所有具备类似 OpenAI / aisuite 接口的 LLM,例如 o1、ollama、gemini、grok、qwen、GLM、deepseek、kimi、doubao。已适配本地 LLM、VLM、GGUF(如 llama-3.3 Janus-Pro、Linkage graphRAG)

    2,348+0近 7 天星标变化
  • docspell@eikek

    协助整理来自扫描器、电子邮件和其他来源的文件堆,只需花费极少的心力。

    2,317+0近 7 天星标变化
  • gowall@Achno

    一款用于转换壁纸配色方案/调色板的工具,支持基于 VLM 的传统与混合 OCR、图片压缩、调色板提取、利用对抗网络进行图片超分辨率放大等更多图像处理功能。

    2,303+0近 7 天星标变化
  • retain-pdf@wxyhgk

    在保留排版、公式与结构的前提下进行 PDF 翻译,适用于科研与技术文档

    2,234+0近 7 天星标变化
  • deepseek-ocr.rs@TimmyOVO

    Rust 多后端 OCR/VLM 引擎(支持 DeepSeek‑OCR-1/2、PaddleOCR‑VL、DotsOCR),具备 DSQ 量化与兼容 OpenAI 的服务器与 CLI —— 无需 Python 即可在本地运行。

    2,184+0近 7 天星标变化
  • SimpleHTR@githubharald

    使用 TensorFlow 实现的手写文字识别(HTR)系统。

    2,184+0近 7 天星标变化
  • tesserocr@sirfz

    tesseract-ocr API 的 Python 包装库

    2,171+0近 7 天星标变化
  • obsidian-omnisearch@scambier

    一个为 Obsidian 设计、开箱即用的搜索引擎。支持 OCR 与 PDF 索引。

    2,131+0近 7 天星标变化
  • docext@NanoNets

    本地部署、无需 OCR 的非结构化数据提取、Markdown 转换与基准测试工具包。(https://idp-leaderboard.org/)

    2,086+0近 7 天星标变化
← 返回主题列表