본문으로 건너뛰기
buildradar
Sign in
토픽 · vision-and-language

vision-and-language

vision-and-language 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
23
총 스타
63,821
평균 스타
2,775
비중
0.00%

같은 리포지토리에 vision-and-language 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 vision-and-language 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • 생성형 AI 연구 업데이트, 면접 자료, 노트북 등을 모두 모아둔 저장소입니다!

    29,211+213최근 7일 스타 변화
  • LAVIS@salesforce

    LAVIS - 언어-비전 인텔리전스를 위한 원스톱 라이브러리

    11,261-1최근 7일 스타 변화
  • maestro@roboflow

    멀티모달 모델(PaliGemma 2, Florence-2, Qwen2.5-VL)의 파인튜닝 과정을 간소화합니다.

    2,695+1최근 7일 스타 변화
  • OmAgent@om-ai-lab

    [EMNLP-2024] 빠른 프로토타입 및 프로덕션을 위한 멀티모달 언어 에이전트 구축

    2,666+1최근 7일 스타 변화
  • ViLT@dandelin

    ICML 2021 (구두 발표) 논문 코드: "ViLT: Vision-and-Language Transformer Without Convolution or Region Supervision"

    1,538+0최근 7일 스타 변화
  • awesome-japanese-llm@llm-jp

    일본어 LLM 모음 - Overview of Japanese LLMs

    1,428+1최근 7일 스타 변화
  • OmDet@om-ai-lab

    실시간 및 정확한 오픈 어휘 엔드투엔드 객체 감지

    1,393+0최근 7일 스타 변화
  • prismer@NVlabs

    "Prismer: A Vision-Language Model with Multi-Task Experts"의 구현체입니다.

    1,309+0최근 7일 스타 변화
  • Aria@rhymes-ai

    오픈 멀티모달 네이티브 MoE인 Aria의 코드베이스

    1,088+1최근 7일 스타 변화
  • ONE-PEACE@OFA-Sys

    비전, 오디오, 언어 모달리티를 아우르는 범용 표현 모델. 논문: ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

    1,060+0최근 7일 스타 변화
  • PointLLM@InternRobotics

    [ECCV 2024 Best Paper Candidate & TPAMI 2025] PointLLM: 대규모 언어 모델이 포인트 클라우드를 이해하도록 역량 강화

    1,053+2최근 7일 스타 변화
  • DoRA@NVlabs

    [ICML2024 (Oral)] DoRA: Weight-Decomposed Low-Rank Adaptation의 공식 PyTorch 구현

    991+1최근 7일 스타 변화
  • calvin@mees

    CALVIN - 장기 로봇 조작 작업을 위한 언어 조건부 정책 학습 벤치마크

    983+8최근 7일 스타 변화
  • groundingLMM@mbzuai-oryx

    [CVPR 2024 🔥] 객체 세분화 마스크와 매끄럽게 통합된 자연어 응답을 생성할 수 있는 최초의 모델인 GLaMM(Grounding Large Multimodal Model)

    967+0최근 7일 스타 변화
  • CVPR 2025의 가장 흥미롭고 영향력 있는 논문들을 엄선하여 모아둔 저장소입니다. 🔥 [논문 + 코드 + 데모]

    895+1최근 7일 스타 변화
  • AlphaCLIP@SunzeY

    [CVPR 2024] Alpha-CLIP: 원하는 곳에 집중하는 CLIP 모델

    874+0최근 7일 스타 변화
  • 가장 흥미롭고 영향력 있는 CVPR 2024 논문을 엄선한 저장소. 🔥 [논문 + 코드 + 데모]

    735+0최근 7일 스타 변화
  • Matterport3DSimulator@peteanderson80

    실제 파노라마 이미지를 활용한 강화학습 AI 연구 플랫폼

    713+2최근 7일 스타 변화
  • 이 저장소는 2023년 CVPR의 가장 흥미롭고 영향력 있는 논문들을 선별한 컬렉션입니다. 🔥 [논문 + 코드]

    649+0최근 7일 스타 변화
  • Proctoring-AI@vardanagarwal

    온라인 시험 감독 자동 모니터링 소프트웨어 개발

    634-1최근 7일 스타 변화
  • 시각-언어 내비게이션 관련 큐레이션 목록. ACL 2022 논문 "Vision-and-Language Navigation: A Survey of Tasks, Methods, and Future Directions"

    607+2최근 7일 스타 변화
  • 엄선된 비전 및 언어 리소스 목록 (작성 중... 기대해 주세요!)

    564+0최근 7일 스타 변화
  • 이 저장소는 서베이 논문 'A Systematic Survey of Prompt Engineering on Vision-Language Foundation Models'에 요약된 관련 논문들을 나열합니다.

    513+0최근 7일 스타 변화
← 토픽 목록으로