본문으로 건너뛰기
buildradar
Sign in
토픽 · multi-modal

multi-modal

multi-modal 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
42
총 스타
189,535
평균 스타
4,513
비중
0.01%

같은 리포지토리에 multi-modal 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 multi-modal 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • agentscope@agentscope-ai

    보고, 이해하고, 신뢰할 수 있는 에이전트를 빌드하고 실행하세요.

    30,463+420최근 7일 스타 변화
  • MiniCPM-V@OpenBMB

    스마트폰에서 초고효율 이미지 및 비디오 이해를 위한 포켓 사이즈 MLLM

    26,283+27최근 7일 스타 변화
  • ten-framework@TEN-framework

    대화형 음성 AI 에이전트를 위한 오픈소스 프레임워크

    11,102+10최근 7일 스타 변화
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] InternVL 패밀리: GPT-4o를 대체하는 선구적인 오픈소스 대안. GPT-4o에 준하는 성능을 가진 오픈소스 멀티모달 대화형 모델

    10,150+3최근 7일 스타 변화
  • modelscope@modelscope

    ModelScope: Model-as-a-Service 개념을 현실화합니다.

    9,121+4최근 7일 스타 변화
  • big-AGI@enricoros

    최첨단 모델을 기반으로 고급 AI/AGI 기능을 제공하는 AI 스위트. AI 페르소나, AGI 기능, 최고 수준의 Beam 멀티 모델 채팅, 텍스트-이미지 변환, 음성, 응답 스트리밍, 코드 강조 및 실행, PDF 가져오기, 개발자용 프리셋 등을 포함합니다. 온프레미스 또는 클라우드에 배포할 수 있습니다.

    7,108+1최근 7일 스타 변화
  • data-juicer@datajuicer

    파운데이션 모델을 위한, 그리고 모델과 함께하는 데이터 처리! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+26최근 7일 스타 변화
  • CogVLM@zai-org

    최첨단 수준의 오픈 시각 언어 모델 | 멀티모달 사전 학습 모델

    6,744+0최근 7일 스타 변화
  • valhalla@valhalla

    OpenStreetMap을 위한 오픈소스 라우팅 엔진

    6,154+24최근 7일 스타 변화
  • Chinese-CLIP@OFA-Sys

    중국어 교차 모달 검색 및 표현 생성을 달성하는 CLIP의 중국어 버전

    6,001+1최근 7일 스타 변화
  • DALLE-pytorch@lucidrains

    PyTorch로 구현/재현한 OpenAI의 텍스트-이미지 변환기 DALL-E

    5,626-2최근 7일 스타 변화
  • marqo@marqo-ai

    이커머스 검색 및 탐색 - marqo.ai

    5,031-1최근 7일 스타 변화
  • DeepKE@zjunlp

    [EMNLP 2022] 지식 그래프 추출 및 구축을 위한 오픈 툴킷

    4,476+1최근 7일 스타 변화
  • VLMEvalKit@open-compass

    대규모 멀티모달 모델(LMM)을 위한 오픈소스 평가 툴킷, 220개 이상의 LMM과 80개 이상의 벤치마크 지원

    4,375+13최근 7일 스타 변화
  • OmniGen@VectorSpaceLab

    OmniGen: 통합 이미지 생성. https://arxiv.org/pdf/2409.11340

    4,342+1최근 7일 스타 변화
  • VisualGLM-6B@zai-org

    중영 다중 모달 대화형 언어 모델

    4,155+0최근 7일 스타 변화
  • LLamaSharp@SciSharp

    로컬 기기에서 LLM(🦙LLaMA/LLaVA)을 효율적으로 실행하기 위한 C#/.NET 라이브러리.

    3,790+2최근 7일 스타 변화
  • Video-LLaVA@PKU-YuanGroup

    【EMNLP 2024🔥】Video-LLaVA: 투영 전 정렬을 통한 통합 시각 표현 학습

    3,500+1최근 7일 스타 변화
  • py-xiaozhi@huangjunsen0406

    MCP 통합, 멀티모달 워크플로, IoT 지원, 크로스 플랫폼 음성 상호작용을 갖춘 오픈소스 AI 어시스턴트 생태계입니다.

    3,463+9최근 7일 스타 변화
  • docarray@docarray

    멀티모달 데이터 표현, 전송, 저장 및 검색

    3,123-1최근 7일 스타 변화
  • LISA@JIA-Lab-research

    "LISA: Reasoning Segmentation via Large Language Model" 프로젝트 페이지

    2,674+0최근 7일 스타 변화
  • CogVLM2@zai-org

    Llama3-8B 기반의 GPT4V 수준 오픈소스 멀티모달 모델

    2,433+0최근 7일 스타 변화
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】 대형 비전-언어 모델을 위한 Mixture-of-Experts

    2,322+0최근 7일 스타 변화
  • RecSysPapers@tangxyw

    추천, 광고, 검색 분야의 산업계 고전 및 최신 논문 모음입니다.

    2,188-1최근 7일 스타 변화
  • MotionGPT@OpenMotionLab

    [NeurIPS 2023] MotionGPT: LLM을 사용한 통합 모션-언어 생성 모델인 외국어로서의 휴먼 모션

    1,963+1최근 7일 스타 변화
  • GPTDiscord@Kav-K

    Discord를 위한 강력한 올인원 GPT 인터페이스. ChatGPT 스타일 대화, 이미지 생성, AI 모더레이션, 커스텀 색인/지식 베이스, 유튜브 요약 등 제공!

    1,853-2최근 7일 스타 변화
  • SALMONN@bytedance

    SALMONN 제품군: 고급 멀티모달 LLM 모음

    1,521+3최근 7일 스타 변화
  • MedMNIST@MedMNIST

    [pip install medmnist] 2D 및 3D 생체 의학 이미지 분류를 위한 18개의 표준화된 데이터셋

    1,399+0최근 7일 스타 변화
  • transfusion-pytorch@lucidrains

    MetaAI의 논문 "Predict the Next Token and Diffuse Images with One Multi-Modal Model"에 등장하는 Transfusion의 PyTorch 구현체입니다.

    1,398+3최근 7일 스타 변화
  • 이 저장소는 "대규모 언어 모델의 지식 증류에 관한 조사(A Survey on Knowledge Distillation of Large Language Models)" 관련 논문을 수집합니다. 지식 증류(KD)를 지식 도출 및 증류 알고리즘으로 세분화하고, LLM의 기술 및 버티컬 증류를 탐구합니다.

    1,306+1최근 7일 스타 변화
← 토픽 목록으로