본문으로 건너뛰기
buildradar
Sign in
토픽 · vlm

vlm

vlm 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
77
총 스타
404,055
평균 스타
5,247
비중
0.02%

같은 리포지토리에 vlm 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 vlm 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • transformers@huggingface

    🤗 Transformers: 텍스트, 비전, 오디오, 멀티모달 모델의 추론 및 학습을 위한 최첨단 머신러닝 모델 정의 프레임워크.

    164,731+119최근 7일 스타 변화
  • UI-TARS-desktop@bytedance

    오픈소스 멀티모달 AI 에이전트 스택: 최첨단 AI 모델과 에이전트 인프라 연결

    38,817+75최근 7일 스타 변화
  • sglang@sgl-project

    SGLang은 대규모 언어 모델 및 멀티모달 모델을 위한 고성능 서빙 프레임워크입니다.

    33,538+791최근 7일 스타 변화
  • runanywhere-sdks@RunanywhereAI

    로컬에서 AI를 실행하기 위한 프로덕션 준비 완료 툴킷

    10,281+1최근 7일 스타 변화
  • PixelRAG@StarTrail-org

    웹 파싱의 끝. 확장 가능한 픽셀 네이티브 검색의 시작. 링크: https://pixelrag.ai/

    9,848+60최근 7일 스타 변화
  • notebooks@roboflow

    최첨단 컴퓨터 비전 모델 및 기술 튜토리얼 모음. ResNet 같은 기본 아키텍처부터 RF-DETR, YOLO11, SAM 3, Qwen3-VL 같은 최신 모델까지 탐색해 보세요.

    9,638+6최근 7일 스타 변화
  • 이상 탐지 관련 도서, 논문, 비디오, 툴박스. LLM 및 VLM 연구를 반영하여 2025년 말에 마지막으로 업데이트되었습니다!

    9,375+5최근 7일 스타 변화
  • GenieX@qualcomm

    몇 줄의 코드로 NPU, GPU, CPU 전반에 걸쳐 Qualcomm 기기에서 로컬로 프론티어 LLM 및 VLM 실행

    8,347+9최근 7일 스타 변화
  • ERNIE@PaddlePaddle

    PaddlePaddle 기반의 산업용 개발 툴킷인 ERNIE 4.5 및 ERNIEKit 공식 저장소

    7,736-1최근 7일 스타 변화
  • VLM-R1@om-ai-lab

    강화된 VLM을 통한 시각적 이해 해결

    6,018+4최근 7일 스타 변화
  • UltraRAG@OpenBMB

    복잡하고 혁신적인 RAG 파이프라인 구축을 위한 로우코드 MCP 프레임워크

    5,678+4최근 7일 스타 변화
  • LLM-RL-Visualized@changyeyu

    🌟100개 이상의 오리지널 LLM / RL 원리 다이어그램📚, '대형 모델 알고리즘' 저자의 역작!💥 (100개 이상의 LLM/RL 알고리즘 맵)

    4,838+12최근 7일 스타 변화
  • star-vector@joanrod

    StarVector는 벡터화를 코드 생성 작업으로 변환하는 SVG 생성 기초 모델입니다. 비전-언어 모델링 아키텍처를 사용하여 시각 및 텍스트 입력을 모두 처리하고 놀라운 정밀도로 고품질 SVG 코드를 생성합니다.

    4,567+6최근 7일 스타 변화
  • lmms-eval@EvolvingLMMs-Lab

    텍스트, 이미지, 비디오, 오디오 작업을 아우르는 올인원 멀티모달 평가 툴킷

    4,390+7최근 7일 스타 변화
  • PromptEnhancer@Hunyuan-PromptEnhancer

    [CVPR 2026] PromptEnhancer는 프롬프트를 더 명확하고 구조화된 버전으로 개선하여 더 나은 이미지를 생성할 수 있도록 돕는 프롬프트 재작성 도구입니다.

    3,766+5최근 7일 스타 변화
  • MiniMax-01@MiniMax-AI

    Linear Attention 기반의 거대 언어 모델 및 비전 언어 모델인 MiniMax-Text-01 및 MiniMax-VL-01의 공식 리포지토리

    3,467+0최근 7일 스타 변화
  • evalscope@modelscope

    효율적인 대형 모델(LLM, VLM, AIGC) 평가 및 성능 벤치마킹을 위한 간소화되고 사용자 정의 가능한 프레임워크입니다.

    3,356+25최근 7일 스타 변화
  • Local-File-Organizer@QiuYannnn

    로컬 텍스트와 이미지를 정리하여 개인 보호를 보장하는 AI 기반 파일 관리 도구입니다. Nexa SDK와 함께 Llama3.2 3B 및 Llava v1.6 모델을 사용하여 빠르고 매끄러운 접근과 쉬운 검색을 위해 파일을 직관적으로 스캔, 재구성 및 정리합니다.

    3,334+0최근 7일 스타 변화
  • Skywork-R1V@SkyworkAI

    Skywork-R1V는 시각-언어 추론에 특화된 Skywork AI 개발의 고급 멀티모달 AI 모델 시리즈입니다.

    3,168+0최근 7일 스타 변화
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: 실제 컴퓨터 환경의 개방형 작업을 위한 멀티모달 에이전트 벤치마킹

    3,118+6최근 7일 스타 변화
  • DeepCamera@SharpAI

    오픈소스 AI 카메라 스킬 플랫폼, AI NVR 및 CCTV 감시. Qwen, DeepSeek, SmolVLM, LLaVA, YOLO26을 이용한 로컬 VLM 비디오 분석. LLM 기반 에이전트 보안 카메라 에이전트 — Telegram, Discord 또는 Slack을 통해 집을 감시, 이해, 기억 및 보호합니다. 플러그인 가능한 AI 스킬. OpenAI, Google, Anthropic 또는 로컬 AI. Mac Mini 및 AI PC에서 실행됩니다.

    3,034+10최근 7일 스타 변화
  • OmAgent@om-ai-lab

    [EMNLP-2024] 빠른 프로토타입 및 프로덕션을 위한 멀티모달 언어 에이전트 구축

    2,666+1최근 7일 스타 변화
  • Cradle@BAAI-Agents

    Cradle 프레임워크는 General Computer Control(GCC)을 위한 첫 번째 시도입니다. 최소한의 요구사항을 가진 표준화된 일반 환경에서 강력한 추론 능력, 자기 개선, 스킬 큐레이션을 통해 에이전트가 모든 컴퓨터 작업을 수행할 수 있도록 지원합니다.

    2,578+2최근 7일 스타 변화
  • GLM-V@zai-org

    GLM-4.6V/4.5V/4.1V-Thinking: 확장 가능한 강화 학습을 통한 다목적 멀티모달 추론 지향

    2,379+2최근 7일 스타 변화
  • comfyui_LLM_party@heshengtao

    ComfyUI의 LLM Agent Framework는 MCP 서버, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 및 FLUX 프롬프트 노드를 포함하며, Feishu와 Discord에 액세스하고, o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi, doubao와 같은 유사한 openai / aisuite 인터페이스를 가진 모든 LLM에 적응합니다. llama-3.3 Janus-Pro, Linkage graphRAG와 같은 로컬 LLM, VLM, GGUF에 적응합니다.

    2,348+5최근 7일 스타 변화
  • paperbanana@llmsresearch

    자동 학술 도표, 다이어그램 및 연구 시각 자료를 위한 Google Research의 PaperBanana 오픈소스 구현 및 확장 버전으로, 슬라이드 생성 등의 새로운 도메인으로 확장되었습니다.

    2,298+10최근 7일 스타 변화
  • ChatGPT Plus/Team/Pro 구독 프로토콜 엔드투엔드 리플레이 툴킷 · hCaptcha 비주얼 솔버 · 안티프라우드 메커니즘 실증 연구

    2,236+7최근 7일 스타 변화
  • tokenspeed@lightseekorg

    TokenSpeed는 초고속 LLM 추론 엔진입니다.

    2,075+44최근 7일 스타 변화
  • Awesome-LM-SSP@CryptoAILab

    대규모 모델 안전, 보안 및 개인정보 보호 관련 읽기 목록 (Awesome LLM Security, Safety 등 포함)

    2,070+0최근 7일 스타 변화
  • Alibaba Cloud의 Qwen-VL 시리즈 파인튜닝을 위한 오픈소스 구현체입니다.

    1,961+1최근 7일 스타 변화
← 토픽 목록으로