multi-modality
multi-modality 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 multi-modality 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 multi-modality 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1★ 25,005+9최근 7일 스타 변화
- #2
:sparkles::sparkles: 멀티모달 대규모 언어 모델의 최신 발전 동향
★ 17,994+8최근 7일 스타 변화 - #3
🏄 CLIP을 사용한 이미지 및 문장의 확장 가능한 임베딩, 추론, 랭킹
★ 12,835+0최근 7일 스타 변화 - #4
MOSS-TTS-Nano는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 다국어 초소형 음성 생성 모델입니다. 0.1B(1억) 개의 파라미터만으로 실시간 음성 생성을 위해 설계되었으며, GPU 없이 CPU에서 직접 실행할 수 있고 로컬 데모, 웹 서빙, 경량 제품 통합을 위해 배포 스택을 충분히 단순하게 유지합니다.
★ 4,279+51최근 7일 스타 변화 - #5
🦦 Otter, OpenFlamingo(DeepMind Flamingo의 오픈소스 버전) 기반의 멀티모달 모델로, MIMIC-IT으로 학습되어 향상된 지시 따르기 및 문맥 내 학습 능력을 보여줍니다.
★ 3,437+2최근 7일 스타 변화 - #6
InternLM-XComposer2.5-OmniLive: 장기 스트리밍 비디오 및 오디오 상호작용을 위한 종합 멀티모달 시스템
★ 2,925+1최근 7일 스타 변화 - #7
3D 객체 추적 관련 알고리즘 및 논문
★ 1,028+2최근 7일 스타 변화 - #8★ 979+1최근 7일 스타 변화
- #9★ 729+2최근 7일 스타 변화
- #10★ 671+2최근 7일 스타 변화
- #11
챗봇 아레나가 멀티모달을 만나다! Multi-Modality Arena는 이미지를 입력으로 사용하여 비전-언어 모델을 나란히 비교하고 벤치마킹할 수 있게 해줍니다. MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 등 다양한 모델을 지원합니다!
★ 566+0최근 7일 스타 변화