본문으로 건너뛰기
buildradar
Sign in
토픽 · multi-modal

multi-modal

multi-modal 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 42개
  • VisRAG@OpenBMB

    VLM을 활용한 파싱 없는 RAG

    979-1최근 7일 스타 변화
  • farmvibes-ai@microsoft

    FarmVibes.AI: 농업 및 지속 가능성을 위한 멀티모달 지리 공간 ML 모델

    895+0최근 7일 스타 변화
  • LanguageBind@PKU-YuanGroup

    【ICLR 2024🔥】 언어 기반 의미론적 정렬을 통한 비디오-언어 사전 학습의 N 모달리티 확장

    885+0최근 7일 스타 변화
  • byaldi@AnswerDotAI

    몇 줄의 코드만으로 ColPali와 같은 지연 상호작용(late-interaction) 멀티모달 모델을 사용해 보세요.

    852+0최근 7일 스타 변화
  • OmniLottie@OpenVGLab

    [CVPR 2026🔥] 🧑‍🎨 OmniLottie, Lottie JSON을 생성하는 오픈소스 멀티모달 지시 기반 벡터 애니메이션 생성기.

    775+4최근 7일 스타 변화
  • Versatile-OCR-Program@raphael-seo

    ML 학습에 최적화된 멀티모달 OCR 파이프라인 (텍스트, 도표, 수식, 표, 다이어그램)

    675-1최근 7일 스타 변화
  • UniControl@salesforce

    통합 제어 가능 시각적 생성 모델

    662+0최근 7일 스타 변화
  • Aether@InternRobotics

    [ICCV 2025 & ICCV 2025 RIWM 우수 논문] Aether: 기하학적 인지 기반의 통합 월드 모델링

    609+0최근 7일 스타 변화
  • RT-2@kyegomez

    RT-2의 대중화: 시각과 언어를 행동으로 변환하는 새로운 모델

    583-1최근 7일 스타 변화
  • fashion-clip@patrickjohncyh

    FashionCLIP은 패션 도메인에 맞게 미세 조정된 CLIP 기반 모델입니다.

    537+3최근 7일 스타 변화
  • forge-film@F-R-L

    멀티 모델 DAG 기반 병렬 AI 영화 생성 — 병렬 가속은 장면 독립성에 비례하며, 장면에 0을 하나씩 생성하는 대신 동시에 생성합니다. 씬 내러티브 종속성을 DAG로 모델링하고 CPM 알고리즘으로 병렬 스케줄링을 구동하는 유일한 영화 생성 엔진

    536+0최근 7일 스타 변화
  • Robust-R1@jqtangust

    [AAAI 2026 Oral] Robust-R1 공식 구현: 견고한 시각적 이해를 위한 열화 인식 추론

    511+0최근 7일 스타 변화
← 토픽 목록으로