본문으로 건너뛰기
buildradar
Sign in
토픽 · image-captioning

image-captioning

image-captioning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
12
총 스타
29,780
평균 스타
2,482
비중
0.00%

같은 리포지토리에 image-captioning 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 image-captioning 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • LAVIS@salesforce

    LAVIS - 언어-비전 인텔리전스를 위한 원스톱 라이브러리

    11,261-1최근 7일 스타 변화
  • sketch-code@ashnkumar

    손으로 그린 웹사이트 목업에서 HTML 코드를 생성하는 Keras 모델. 소스 이미지로부터 드로잉하기 위한 이미지 캡셔닝 아키텍처 구현

    5,143+0최근 7일 스타 변화
  • InternGPT@OpenGVLab

    InternGPT (iGPT)는 AI 모델을 쉽게 시각화할 수 있는 오픈소스 데모 플랫폼입니다. 이제 DragGAN, ChatGPT, ImageBind, GPT-4와 같은 멀티모달 채팅, SAM, 대화형 이미지 편집 등을 지원합니다. igpt.opengvlab.com에서 체험해 보세요.

    3,205+0최근 7일 스타 변화
  • OFA@OFA-Sys

    OFA (ICML 2022) 공식 저장소. 논문: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    2,557+0최근 7일 스타 변화
  • CameraManager@imaginary-cloud

    앱에서 커스텀 카메라 뷰를 만드는 데 필요한 모든 구성을 제공하는 간단한 Swift 클래스

    1,395-1최근 7일 스타 변화
  • taggui@jhc13

    이미지 데이터셋을 위한 태그 관리자 및 캡션 생성기

    1,348+2최근 7일 스타 변화
  • prismer@NVlabs

    "Prismer: A Vision-Language Model with Multi-Task Experts"의 구현체입니다.

    1,309+0최근 7일 스타 변화
  • :fire: :fire: :fire: 최근 컴퓨터 비전(CV) 관련 논문 목록

    973+1최근 7일 스타 변화
  • ZerolanLiveRobot@AkagawaTsurunaki

    LLM, ASR, TTS, OCR, CV 등 다양한 기술을 활용하여 라이브 스트리밍을 하거나 함께 Minecraft를 플레이하는 AI VTuber

    802+4최근 7일 스타 변화
  • 주요 파운데이션 및 멀티모달 모델을 정리한 큐레이션 리스트 (논문, 코드, 예제, 튜토리얼 포함)

    637+0최근 7일 스타 변화
  • ComfyUI_VLM_nodes@gokayfem

    Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V 등 비전-언어 모델을 위한 ComfyUI 노드입니다. 오픈 어휘 탐지, SAM2/SAM3 세그멘테이션, 비디오 시간 추론, llama.cpp 기반 GGUF 및 호스팅된 LLM/VLM API를 지원합니다.

    588-1최근 7일 스타 변화
  • virtex@kdexd

    [CVPR 2021] VirTex: 텍스트 주석을 통한 시각적 표현 학습

    563+0최근 7일 스타 변화
← 토픽 목록으로