跳到主要内容
buildradar
Sign in
主题 · vision

vision

标记 vision 主题、收录中的开源项目,按星标数排序。

项目数
33
总星标数
238,709
平均星标数
7,234
占比
0.01%

常跟 vision 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 vision 主题的项目。

  • 为纯文本模型“看图”设计更好的视觉工具箱和技能,支持多图理解、图片问答、前端UI还原、GUI 自动化等,并可选无缝接入多个主流agent,直接识别粘贴图片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode

    1,136
  • dsh-vision-router@ysr666

    专为纯文本 DeepSeek Harness 代理设计的视觉眼:内置免费视觉链(无需密钥)与像素级视觉工具(问答、定位、裁剪、像素差异、颜色、OCR、SVG 描摹、抠图、截图)。一键安装,无需 Python,图片处理就像一般的工具调用一样。

    1,089
  • LibreChat@danny-avila

    增强版 ChatGPT 克隆:具备 Agents、MCP、Skills、DeepSeek、Anthropic、AWS、OpenAI、Responses API、Azure、Groq、o1、GPT-5、Mistral、OpenRouter、Vertex AI、Gemini、Artifacts、AI 模型切换、消息搜索、代码解释器、langchain、DALL‑E‑3、OpenAPI Actions、Functions、Secure Multi‑User Auth、预设,开源自托管,持续活跃

    42,743+146近 7 天星标变化
  • Xray,穿透一切。也是最佳的 v2ray-core。魔法发生之处。提供多种用途的开放平台。

    41,371+89近 7 天星标变化
  • UI-TARS-desktop@bytedance

    开源多模态 AI 代理堆栈:连接最前沿的 AI 模型与代理基础设施

    38,817+75近 7 天星标变化
  • caffe@BVLC

    Caffe:一个快速的开源深度学习框架

    34,553-2近 7 天星标变化
  • skyvern@Skyvern-AI

    使用 AI 自动化基于浏览器的工作流程

    22,915+37近 7 天星标变化
  • PixelRAG@StarTrail-org

    网页解析的终点,像素原生搜索的起点。 link: https://pixelrag.ai/

    9,848+60近 7 天星标变化
  • 📸 功能强大且高性能的 React Native 相机库。

    9,599+13近 7 天星标变化
  • modlens@liustack

    DeepSeek Harness 的第一个视觉插件,以及每个纯文字编码代理的视觉桥接。粘贴图片,即可获得结构化 JSON 证据(OCR、版面、语义)。 | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。

    3,839+83近 7 天星标变化
  • SimpleMem@aiming-lab

    SimpleMem:LLM 代理的高效终身记忆 — 文本与多模态

    3,735+9近 7 天星标变化
  • donkeycar@autorope

    开源硬件与软件平台,用于构建小型自驾车。

    3,500+4近 7 天星标变化
  • Torch-Pruning@VainF

    [CVPR 2023] DepGraph:迈向任意结构剪枝;LLMs、视觉基础模型等。

    3,351+3近 7 天星标变化
  • SimpleCV@sightmachine

    机器视觉开源框架

    2,730+0近 7 天星标变化
  • NextLevel@NextLevel

    ⬆️ Swift 中的媒体捕获

    2,331-1近 7 天星标变化
  • java-docs-samples@GoogleCloudPlatform

    cloud.google.com 上使用的 Java 与 Kotlin 代码示例

    1,907+1近 7 天星标变化
  • ha-llmvision@valentinfrlch

    你家的视觉智能。

    1,454+10近 7 天星标变化
  • aravis@AravisProject

    基于 genicam 相机的视觉库

    1,272+3近 7 天星标变化
  • Deep-Learning-Experiments@roatienza

    用于理解深度学习的视频、笔记与实验。

    1,198+0近 7 天星标变化
  • MLKit@jenly1314

    MLKit 是一个强大易用的工具包。通过 ML Kit 您可以很轻松地实现文字识别、条码识别、图像标记、人脸检测、对象检测等功能。

    1,171+3近 7 天星标变化
  • 为纯文本模型“看图”设计更好的视觉工具箱和技能,支持多图理解、图片问答、前端UI还原、GUI 自动化等,并可选无缝接入多个主流agent,直接识别粘贴图片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode

    1,136+18近 7 天星标变化
  • dsh-vision-router@ysr666

    专为纯文本 DeepSeek Harness 代理设计的视觉眼:内置免费视觉链(无需密钥)与像素级视觉工具(问答、定位、裁剪、像素差异、颜色、OCR、SVG 描摹、抠图、截图)。一键安装,无需 Python,图片处理就像一般的工具调用一样。

    1,089+64近 7 天星标变化
  • mlp-mixer-pytorch@lucidrains

    来自 Google AI 的视觉 All-MLP 解决方案

    1,063+0近 7 天星标变化
  • calvin@mees

    CALVIN - 用于长视距机器人操作任务的语言条件策略学习基准测试

    985+10近 7 天星标变化
  • CudaSift@Celebrandil

    适用于 NVidia GPU 的 SIFT CUDA 实现(在 GTX 1060 上为 1.2 毫秒)。

    953+0近 7 天星标变化
  • iowncode@anupamchugh

    精选的 iOS、ML、AR 资源集合,并点缀了一些 UI 元素

    911+0近 7 天星标变化
  • 3dmatch-toolbox@andyzeng

    3DMatch - 基于 3D ConvNet 的区域几何描述符,用于对齐 3D 网格与点云。

    905+0近 7 天星标变化
  • caer@jasmcaus

    Python高性能Vision库。扩展你的研究,而非重复的代码。

    816+0近 7 天星标变化
  • 🎰 精选的机器学习资源列表,以 CoreML 为主

    813+0近 7 天星标变化
  • interpreter@bquenin

    这个应用程序可以翻译在计算机上运行的任何应用程序所捕获的文本。

    776+25近 7 天星标变化
  • design2code@mostafasadeghi97

    将任何网页设计截图转换为干净的 HTML/CSS 代码

    681+1近 7 天星标变化
  • myvision@OvidijusParsiunas

    基于计算机视觉的 ML 训练数据生成工具 :rocket:

    612+0近 7 天星标变化
← 返回主题列表