跳到主要内容
buildradar
Sign in
主题 · ocr

ocr

标记 ocr 主题、收录中的开源项目,按星标数排序。

共 186 个项目
  • omniparse@adithya-s-k

    获取、解析并优化任何数据格式 ➡️ 从文档到多媒体 ➡️ 提升与 GenAI 框架的兼容性

    7,823+4近 7 天星标变化
  • RapidOCR@RapidAI

    📄 Awesome OCR 多语言工具套件,基于 ONNX Runtime、OpenVINO、MNN、PaddlePaddle、TensorRT 与 PyTorch

    7,664+47近 7 天星标变化
  • tessdata@tesseract-ocr

    使用快速版“最佳”LSTM模型和旧版模型训练的模型

    7,647+4近 7 天星标变化
  • GLM-OCR@zai-org

    GLM-OCR:精准 × 快速 × 完整

    7,385+11近 7 天星标变化
  • unstract@Zipstack

    LLM 驱动的非结构化数据抽取 — 为 API 部署与 ETL 工作流设计

    7,191+9近 7 天星标变化
  • eSearch@xushengfeng

    截屏 离线 OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持 Windows Linux macOS

    7,066+18近 7 天星标变化
  • donut@clovaai

    官方实现 OCR-free Document Understanding Transformer(Donut)与 Synthetic Document Generator(SynthDoG),ECCV 2022。

    6,917-2近 7 天星标变化
  • doctr@mindee

    docTR (Document Text Recognition) - 一个无缝、高效且易于使用的 OCR 相关任务库,采用深度学习技术。由 t2k 持续开发与维护

    6,335+12近 7 天星标变化
  • PaddleX@PaddlePaddle

    基于 PaddlePaddle 的全功能开发工具

    6,254+3近 7 天星标变化
  • pdf-craft@oomol-lab

    PDF craft 可将 PDF 文件转换为各种其他格式。本项目将专注于处理扫描书籍的 PDF 文件

    6,245+13近 7 天星标变化
  • Parsr@axa-group

    将PDF、文件和图像转换为增强结构化数据

    6,176-2近 7 天星标变化
  • layout-parser@Layout-Parser

    一个统一的深度学习文档图像分析工具包

    5,776+2近 7 天星标变化
  • Translumo@ramjke

    高级实时屏幕翻译器,适用于游戏、视频硬编码字幕、静态文本等

    5,722+13近 7 天星标变化
  • flyingmouse-format@LaoFeng-mouse

    飞鼠格式 FlyingMouse Format - Windows 免费文件格式转换工具(离线可用,内置 FFmpeg/LibreOffice/Poppler/Tesseract)。图片/文档/表格/PPT/PDF/音视频/WPS 格式互转 + OCR + 批量转换;音频仅支持普通格式。作者:牢蜂(LaoFeng)|仅供个人免费使用,禁止商业售卖/转卖/套壳

    5,605+615近 7 天星标变化
  • 深度学习辅助漫画翻译工具,支持一键机翻与简单的图像/文字编辑 | Yet another computer-aided comic/manga translation tool powered by deeplearning

    5,096+18近 7 天星标变化
  • Text-Grab@TheJoeFin

    在 Windows 上快速轻松使用 OCR,配备可选后台进程与通知

    4,985+5近 7 天星标变化
  • snow-apps@mg-chao

    Snow Apps repository, 提供 Snow Shot 与 Snow Image Viewer 的原始码。

    4,934+6近 7 天星标变化
  • mmocr@open-mmlab

    OpenMMLab 文本检测、识别与理解工具箱

    4,752-1近 7 天星标变化
  • jabref@JabRef

    管理 BibTeX 与 BibLaTeX (.bib) 库的桌面应用程序

    4,681+20近 7 天星标变化
  • TNN@Tencent

    TNN:由腾讯优图实验室和光影实验室开发的统一深度学习推理框架,适用于手机、桌面和服务器。TNN 以跨平台能力、高性能、模型压缩和代码裁剪等优秀特性著称。基于 ncnn 和 Rapidnet,TNN 进一步加强了对手机设备的支持和性能优化,并且

    4,649+1近 7 天星标变化
  • naps2@cyanfish

    扫描文件至 PDF 及更多,尽可能简单。

    4,481+9近 7 天星标变化
  • RuVector@ruvnet

    RuVector 是一个高性能、实时、自学 AI 向量 GNN,内建 Rust 记忆体数据库

    4,473+6近 7 天星标变化
  • LLPlayer@umlx5h

    语言学习媒体播放器,支持双字幕、AI 生成字幕、实时翻译等功能。

    4,070+12近 7 天星标变化
  • deep-text-recognition-benchmark@clovaai

    使用深度学习方法的文字识别(光学字符识别),ICCV 2019

    3,942+0近 7 天星标变化
  • modlens@liustack

    DeepSeek Harness 的第一个视觉插件,以及每个纯文字编码代理的视觉桥接。粘贴图片,即可获得结构化 JSON 证据(OCR、版面、语义)。 | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。

    3,839+83近 7 天星标变化
  • KillerPDF@SteveTheKiller

    免费且开源的 Windows PDF 编辑器。可查看、注解、OCR、合并、拆分、编辑文字、绘图、签名、填写表单、打印、扁平化,并可打开受密码保护的 PDF,无需订阅。可安装或执行便携版。GPLv3

    3,749+63近 7 天星标变化
  • 文字识别合成数据生成器

    3,693+2近 7 天星标变化
  • AdelaiDet@aim-uofa

    AdelaiDet is an open source toolbox for multiple instance-level detection and recognition tasks.

    3,477+0近 7 天星标变化
  • CRAFT-pytorch@clovaai

    文字检测的字符区域感知(CRAFT)官方实现

    3,398-1近 7 天星标变化
  • TTime@InkTimeRecord

    🚀 截图、划词、OCR、AI、翻译软件

    3,355+7近 7 天星标变化
← 返回主题列表