본문으로 건너뛰기
buildradar
Sign in
토픽 · vision

vision

vision 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
32
총 스타
237,577
평균 스타
7,424
비중
0.01%

같은 리포지토리에 vision 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 vision 태그가 달린 리포지토리예요.

  • 텍스트 전용 LLM을 위한 더 나은 시각 툴킷 및 스킬(다중 이미지 이해, 이미지 Q&A, 프론트엔드 UI 복원, GUI 자동화 등 지원, 여러 주요 에이전트와 선택적 연동 가능, 복사한 이미지 직접 인식)

    1,127
  • dsh-vision-router@ysr666

    텍스트 전용 DeepSeek Harness agent를 위한 비전 기능: 내장 무료 비전 체인(키 불필요) + 픽셀 수준 비전 도구(Q&A, 그라운딩, 자르기, 픽셀 차이, 색상, OCR, SVG 추적, 누끼, 스크린샷). 명령어 하나로 설치, Python 불필요, 이미지 작업이 일반적인 도구 호출 작업처럼 작동합니다.

    1,034
  • LibreChat@danny-avila

    향상된 ChatGPT 클론: 에이전트, MCP, 스킬, DeepSeek, Anthropic, AWS, OpenAI, 응답 API, Azure, Groq, o1, GPT-5, Mistral, OpenRouter, Vertex AI, Gemini, 아티팩트, AI 모델 전환, 메시지 검색, 코드 인터프리터, langchain, DALL-E-3, OpenAPI 액션, 함수, 안전한 다중 사용자 인증, 프리셋 지원 및 자체 호스팅 가능한 오픈 소스. 활발히 유지보수 중

    42,597+274최근 7일 스타 변화
  • Xray, Penetrates Everything. 또한 최고의 v2ray-core. 마법이 일어나는 곳. 다양한 용도를 위한 오픈 플랫폼.

    41,282+130최근 7일 스타 변화
  • UI-TARS-desktop@bytedance

    오픈소스 멀티모달 AI 에이전트 스택: 최첨단 AI 모델과 에이전트 인프라 연결

    38,742+62최근 7일 스타 변화
  • caffe@BVLC

    Caffe: 딥러닝을 위한 빠르고 개방된 프레임워크

    34,555-5최근 7일 스타 변화
  • skyvern@Skyvern-AI

    AI를 활용한 브라우저 기반 워크플로우 자동화

    22,878+52최근 7일 스타 변화
  • PixelRAG@StarTrail-org

    웹 파싱의 끝. 확장 가능한 픽셀 네이티브 검색의 시작. 링크: https://pixelrag.ai/

    9,788+134최근 7일 스타 변화
  • 📸 강력하고 고성능인 React Native 카메라 라이브러리.

    9,586+18최근 7일 스타 변화
  • modlens@liustack

    DeepSeek Harness를 위한 최초의 비전 플러그인이자, 모든 텍스트 전용 코딩 에이전트를 위한 비전 브리지입니다. 이미지를 붙여넣으면 구조화된 JSON 증거(OCR, 레이아웃, 시맨틱)를 얻을 수 있습니다.

    3,756+255최근 7일 스타 변화
  • SimpleMem@aiming-lab

    SimpleMem: LLM 에이전트를 위한 효율적인 평생 메모리 — 텍스트 및 멀티모달

    3,726+18최근 7일 스타 변화
  • donkeycar@autorope

    소규모 자율주행 차량을 구축하기 위한 오픈소스 하드웨어 및 소프트웨어 플랫폼

    3,496+2최근 7일 스타 변화
  • Torch-Pruning@VainF

    [CVPR 2023] DepGraph: 범용 구조적 가지치기; LLMs, Vision Foundation Models 등

    3,348+1최근 7일 스타 변화
  • SimpleCV@sightmachine

    머신 비전을 위한 오픈 소스 프레임워크

    2,730+1최근 7일 스타 변화
  • NextLevel@NextLevel

    ⬆️ Swift에서의 미디어 캡처

    2,331-1최근 7일 스타 변화
  • java-docs-samples@GoogleCloudPlatform

    cloud.google.com에서 사용되는 Java 및 Kotlin 코드 샘플

    1,906+1최근 7일 스타 변화
  • ha-llmvision@valentinfrlch

    가정을 위한 시각 지능.

    1,446+10최근 7일 스타 변화
  • aravis@AravisProject

    GenICam 기반 카메라를 위한 비전 라이브러리

    1,270+2최근 7일 스타 변화
  • Deep-Learning-Experiments@roatienza

    딥러닝을 이해하기 위한 비디오, 노트 및 실험

    1,198+1최근 7일 스타 변화
  • MLKit@jenly1314

    🌝 MLKit은 강력하고 사용하기 쉬운 툴킷입니다. ML Kit을 통해 텍스트 인식, 바코드 인식, 이미지 라벨링, 얼굴 감지, 객체 감지 등의 기능을 쉽게 구현할 수 있습니다.

    1,169+1최근 7일 스타 변화
  • 텍스트 전용 LLM을 위한 더 나은 시각 툴킷 및 스킬(다중 이미지 이해, 이미지 Q&A, 프론트엔드 UI 복원, GUI 자동화 등 지원, 여러 주요 에이전트와 선택적 연동 가능, 복사한 이미지 직접 인식)

    1,127+23최근 7일 스타 변화
  • mlp-mixer-pytorch@lucidrains

    Google AI에서 제공하는 비전용 All-MLP 솔루션

    1,064+1최근 7일 스타 변화
  • dsh-vision-router@ysr666

    텍스트 전용 DeepSeek Harness agent를 위한 비전 기능: 내장 무료 비전 체인(키 불필요) + 픽셀 수준 비전 도구(Q&A, 그라운딩, 자르기, 픽셀 차이, 색상, OCR, SVG 추적, 누끼, 스크린샷). 명령어 하나로 설치, Python 불필요, 이미지 작업이 일반적인 도구 호출 작업처럼 작동합니다.

    1,034+85최근 7일 스타 변화
  • calvin@mees

    CALVIN - 장기 로봇 조작 작업을 위한 언어 조건부 정책 학습 벤치마크

    977+5최근 7일 스타 변화
  • CudaSift@Celebrandil

    NVIDIA GPU용 SIFT의 CUDA 구현 (GTX 1060에서 1.2ms)

    953+2최근 7일 스타 변화
  • iowncode@anupamchugh

    iOS, ML, AR 리소스 모음 및 UI 추가 요소

    911+0최근 7일 스타 변화
  • 3dmatch-toolbox@andyzeng

    3D 맺(mesh)과 점群(point cloud) 정렬을 위한 3D ConvNet 기반 로컬 기하학적 디스크립터, 3DMatch

    905+1최근 7일 스타 변화
  • caer@jasmcaus

    Python의 고성능 비전 라이브러리. 보일러플레이트 대신 연구를 확장하세요.

    816+2최근 7일 스타 변화
  • CoreML 위주의 머신러닝 리소스 큐레이션 목록

    813+0최근 7일 스타 변화
  • interpreter@bquenin

    컴퓨터에서 실행 중인 모든 애플리케이션의 텍스트를 캡처하여 번역하는 애플리케이션

    754+12최근 7일 스타 변화
  • design2code@mostafasadeghi97

    웹 디자인 스크린샷을 깔끔한 HTML/CSS 코드로 변환합니다.

    681-1최근 7일 스타 변화
  • myvision@OvidijusParsiunas

    컴퓨터 비전 기반의 ML 학습 데이터 생성 도구

    612+0최근 7일 스타 변화
← 토픽 목록으로