vision
Các kho mã nguồn mở đang theo dõi được gắn thẻ vision, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng vision trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ vision.
- #1
Bộ công cụ thị giác và kỹ năng được thiết kế cho các mô hình thuần văn bản để "xem ảnh" — hỗ trợ hiểu đa ảnh, hỏi đáp hình ảnh, khôi phục UI frontend, tự động hóa GUI và tích hợp liền mạch tùy chọn vào nhiều agent phổ biến, nhận diện trực tiếp ảnh dán | Bộ công cụ thị giác và kỹ năng thiết kế cho LLM thuần văn bản — hỏi đáp hình ảnh, OCR ảnh chụp màn hình dài, khôi phục UI frontend và tự động hóa GUI, tích hợp liền mạch tùy chọn cho Codex, Claude Code, Pi, Oh My Pi và OpenCode
★ 1.127 - #2
Đôi mắt cho các tác nhân DeepSeek Harness chỉ có văn bản: chuỗi thị giác miễn phí tích hợp (không cần khóa) + công cụ thị giác cấp độ điểm ảnh (Hỏi đáp, định vị, cắt, so sánh điểm ảnh, màu sắc, OCR, dò tìm SVG, tách nền, ảnh chụp màn hình). Cài đặt bằng một lệnh, không cần Python, các lượt xử lý hình ảnh hoạt động giống như các lượt gọi công cụ thông thường.
★ 1.039
- #1
Bản sao ChatGPT nâng cao: Tích hợp Agents, MCP, Skills, DeepSeek, Anthropic, AWS, OpenAI, Responses API, Azure, Groq, o1, GPT-5, Mistral, OpenRouter, Vertex AI, Gemini, Artifacts, chuyển đổi mô hình AI, tìm kiếm tin nhắn, Code Interpreter, langchain, DALL-E-3, OpenAPI Actions, Functions, Xác thực đa người dùng bảo mật, Presets, mã nguồn mở để tự lưu trữ. Đang hoạt động
★ 42.597+274Thay đổi số sao trong 7 ngày qua - #2
Xray, thâm nhập mọi thứ. Đồng thời là v2ray-core tốt nhất. Nơi phép màu diễn ra. Một nền tảng mở cho nhiều mục đích sử dụng khác nhau.
★ 41.282+130Thay đổi số sao trong 7 ngày qua - #3
Stack AI Agent đa thức nguồn mở: Kết nối các mô hình AI tiên tiến và hạ tầng Agent
★ 38.742+62Thay đổi số sao trong 7 ngày qua - #4★ 34.555-5Thay đổi số sao trong 7 ngày qua
- #5★ 22.878+52Thay đổi số sao trong 7 ngày qua
- #6
Chấm dứt việc phân tích cú pháp web. Khởi đầu của tìm kiếm gốc điểm ảnh có khả năng mở rộng. liên kết: https://pixelrag.ai/
★ 9.788+134Thay đổi số sao trong 7 ngày qua - #7
📸 Thư viện React Native Camera mạnh mẽ và hiệu năng cao.
★ 9.586+18Thay đổi số sao trong 7 ngày qua - #8
Plugin thị giác đầu tiên cho DeepSeek Harness, và cầu nối thị giác cho mọi coding agent chỉ hỗ trợ văn bản. Dán hình ảnh, nhận dữ liệu JSON có cấu trúc (OCR, bố cục, ngữ nghĩa).
★ 3.756+255Thay đổi số sao trong 7 ngày qua - #9
SimpleMem: Bộ nhớ suốt đời hiệu quả cho các tác nhân LLM — Văn bản & Đa phương thức
★ 3.726+18Thay đổi số sao trong 7 ngày qua - #10
Nền tảng phần cứng và phần mềm mã nguồn mở để chế tạo một chiếc xe tự lái quy mô nhỏ.
★ 3.496+2Thay đổi số sao trong 7 ngày qua - #11
[CVPR 2023] DepGraph: Hướng tới Cắt tỉa Cấu trúc Bất kỳ; LLMs, Vision Foundation Models, v.v.
★ 3.348+1Thay đổi số sao trong 7 ngày qua - #12★ 2.730+1Thay đổi số sao trong 7 ngày qua
- #13★ 2.331-1Thay đổi số sao trong 7 ngày qua
- #14
Mã nguồn mẫu Java và Kotlin được sử dụng trên cloud.google.com
★ 1.906+1Thay đổi số sao trong 7 ngày qua - #15
Trí tuệ trực quan cho ngôi nhà của bạn.
★ 1.446+10Thay đổi số sao trong 7 ngày qua - #16★ 1.270+2Thay đổi số sao trong 7 ngày qua
- #17
Video, ghi chú và các thí nghiệm để tìm hiểu về deep learning
★ 1.198+1Thay đổi số sao trong 7 ngày qua - #18
MLKit là một bộ công cụ mạnh mẽ và dễ sử dụng. Thông qua ML Kit, bạn có thể dễ dàng hiện thực hóa các tính năng như nhận dạng văn bản, nhận dạng mã vạch, gán nhãn hình ảnh, phát hiện khuôn mặt và phát hiện đối tượng.
★ 1.169+1Thay đổi số sao trong 7 ngày qua - #19
Bộ công cụ thị giác và kỹ năng được thiết kế cho các mô hình thuần văn bản để "xem ảnh" — hỗ trợ hiểu đa ảnh, hỏi đáp hình ảnh, khôi phục UI frontend, tự động hóa GUI và tích hợp liền mạch tùy chọn vào nhiều agent phổ biến, nhận diện trực tiếp ảnh dán | Bộ công cụ thị giác và kỹ năng thiết kế cho LLM thuần văn bản — hỏi đáp hình ảnh, OCR ảnh chụp màn hình dài, khôi phục UI frontend và tự động hóa GUI, tích hợp liền mạch tùy chọn cho Codex, Claude Code, Pi, Oh My Pi và OpenCode
★ 1.127+23Thay đổi số sao trong 7 ngày qua - #20
Giải pháp All-MLP cho Thị giác máy tính từ Google AI
★ 1.064+1Thay đổi số sao trong 7 ngày qua - #21
Đôi mắt cho các tác nhân DeepSeek Harness chỉ có văn bản: chuỗi thị giác miễn phí tích hợp (không cần khóa) + công cụ thị giác cấp độ điểm ảnh (Hỏi đáp, định vị, cắt, so sánh điểm ảnh, màu sắc, OCR, dò tìm SVG, tách nền, ảnh chụp màn hình). Cài đặt bằng một lệnh, không cần Python, các lượt xử lý hình ảnh hoạt động giống như các lượt gọi công cụ thông thường.
★ 1.039+85Thay đổi số sao trong 7 ngày qua - #22
CALVIN - Điểm chuẩn cho Học chính sách theo điều kiện ngôn ngữ đối với các tác vụ thao tác robot dài hạn
★ 977+5Thay đổi số sao trong 7 ngày qua - #23★ 953+2Thay đổi số sao trong 7 ngày qua
- #24
Bộ sưu tập các tài nguyên về iOS, ML, AR cùng với một số bổ sung về giao diện người dùng
★ 911+0Thay đổi số sao trong 7 ngày qua - #25
3DMatch - bộ mô tả hình học cục bộ dựa trên 3D ConvNet để căn chỉnh lưới 3D và đám mây điểm.
★ 905+1Thay đổi số sao trong 7 ngày qua - #26
Thư viện thị giác máy tính hiệu năng cao bằng Python. Mở rộng quy mô nghiên cứu của bạn, không cần boilerplate.
★ 816+2Thay đổi số sao trong 7 ngày qua - #27
🎰 Danh sách các tài nguyên học máy được tuyển chọn, ưu tiên CoreML.
★ 813+0Thay đổi số sao trong 7 ngày qua - #28
Ứng dụng này có thể dịch văn bản được chụp từ bất kỳ ứng dụng nào đang chạy trên máy tính của bạn.
★ 754+12Thay đổi số sao trong 7 ngày qua - #29
Chuyển đổi bất kỳ ảnh chụp màn hình thiết kế web nào thành mã HTML/CSS sạch.
★ 681-1Thay đổi số sao trong 7 ngày qua - #30★ 612+0Thay đổi số sao trong 7 ngày qua