vision
vision 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 vision 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 vision 태그가 달린 리포지토리예요.
- #1
텍스트 전용 LLM을 위한 더 나은 시각 툴킷 및 스킬(다중 이미지 이해, 이미지 Q&A, 프론트엔드 UI 복원, GUI 자동화 등 지원, 여러 주요 에이전트와 선택적 연동 가능, 복사한 이미지 직접 인식)
★ 1,127 - #2
텍스트 전용 DeepSeek Harness agent를 위한 비전 기능: 내장 무료 비전 체인(키 불필요) + 픽셀 수준 비전 도구(Q&A, 그라운딩, 자르기, 픽셀 차이, 색상, OCR, SVG 추적, 누끼, 스크린샷). 명령어 하나로 설치, Python 불필요, 이미지 작업이 일반적인 도구 호출 작업처럼 작동합니다.
★ 1,034
- #1
향상된 ChatGPT 클론: 에이전트, MCP, 스킬, DeepSeek, Anthropic, AWS, OpenAI, 응답 API, Azure, Groq, o1, GPT-5, Mistral, OpenRouter, Vertex AI, Gemini, 아티팩트, AI 모델 전환, 메시지 검색, 코드 인터프리터, langchain, DALL-E-3, OpenAPI 액션, 함수, 안전한 다중 사용자 인증, 프리셋 지원 및 자체 호스팅 가능한 오픈 소스. 활발히 유지보수 중
★ 42,597+274최근 7일 스타 변화 - #2★ 41,282+130최근 7일 스타 변화
- #3
오픈소스 멀티모달 AI 에이전트 스택: 최첨단 AI 모델과 에이전트 인프라 연결
★ 38,742+62최근 7일 스타 변화 - #4★ 34,555-5최근 7일 스타 변화
- #5★ 22,878+52최근 7일 스타 변화
- #6★ 9,788+134최근 7일 스타 변화
- #7
📸 강력하고 고성능인 React Native 카메라 라이브러리.
★ 9,586+18최근 7일 스타 변화 - #8
DeepSeek Harness를 위한 최초의 비전 플러그인이자, 모든 텍스트 전용 코딩 에이전트를 위한 비전 브리지입니다. 이미지를 붙여넣으면 구조화된 JSON 증거(OCR, 레이아웃, 시맨틱)를 얻을 수 있습니다.
★ 3,756+255최근 7일 스타 변화 - #9★ 3,726+18최근 7일 스타 변화
- #10★ 3,496+2최근 7일 스타 변화
- #11
[CVPR 2023] DepGraph: 범용 구조적 가지치기; LLMs, Vision Foundation Models 등
★ 3,348+1최근 7일 스타 변화 - #12★ 2,730+1최근 7일 스타 변화
- #13★ 2,331-1최근 7일 스타 변화
- #14
cloud.google.com에서 사용되는 Java 및 Kotlin 코드 샘플
★ 1,906+1최근 7일 스타 변화 - #15
가정을 위한 시각 지능.
★ 1,446+10최근 7일 스타 변화 - #16★ 1,270+2최근 7일 스타 변화
- #17
딥러닝을 이해하기 위한 비디오, 노트 및 실험
★ 1,198+1최근 7일 스타 변화 - #18
🌝 MLKit은 강력하고 사용하기 쉬운 툴킷입니다. ML Kit을 통해 텍스트 인식, 바코드 인식, 이미지 라벨링, 얼굴 감지, 객체 감지 등의 기능을 쉽게 구현할 수 있습니다.
★ 1,169+1최근 7일 스타 변화 - #19
텍스트 전용 LLM을 위한 더 나은 시각 툴킷 및 스킬(다중 이미지 이해, 이미지 Q&A, 프론트엔드 UI 복원, GUI 자동화 등 지원, 여러 주요 에이전트와 선택적 연동 가능, 복사한 이미지 직접 인식)
★ 1,127+23최근 7일 스타 변화 - #20
Google AI에서 제공하는 비전용 All-MLP 솔루션
★ 1,064+1최근 7일 스타 변화 - #21
텍스트 전용 DeepSeek Harness agent를 위한 비전 기능: 내장 무료 비전 체인(키 불필요) + 픽셀 수준 비전 도구(Q&A, 그라운딩, 자르기, 픽셀 차이, 색상, OCR, SVG 추적, 누끼, 스크린샷). 명령어 하나로 설치, Python 불필요, 이미지 작업이 일반적인 도구 호출 작업처럼 작동합니다.
★ 1,034+85최근 7일 스타 변화 - #22★ 977+5최근 7일 스타 변화
- #23★ 953+2최근 7일 스타 변화
- #24★ 911+0최근 7일 스타 변화
- #25
3D 맺(mesh)과 점群(point cloud) 정렬을 위한 3D ConvNet 기반 로컬 기하학적 디스크립터, 3DMatch
★ 905+1최근 7일 스타 변화 - #26★ 816+2최근 7일 스타 변화
- #27
CoreML 위주의 머신러닝 리소스 큐레이션 목록
★ 813+0최근 7일 스타 변화 - #28
컴퓨터에서 실행 중인 모든 애플리케이션의 텍스트를 캡처하여 번역하는 애플리케이션
★ 754+12최근 7일 스타 변화 - #29
웹 디자인 스크린샷을 깔끔한 HTML/CSS 코드로 변환합니다.
★ 681-1최근 7일 스타 변화 - #30★ 612+0최근 7일 스타 변화