visual-language-learning
Repositórios de código aberto acompanhados marcados com visual-language-learning, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de visual-language-learning no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com visual-language-learning.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) desenvolvido para alcançar recursos do nível do GPT-4V e além.
★ 25.005+9Variação de estrelas nos últimos 7 dias - #2
Código e modelos para o artigo do ICML 2024, NExT-GPT: Any-to-Any Multimodal Large Language Model
★ 3.635-1Variação de estrelas nos últimos 7 dias - #3
Otter, um modelo multimodal baseado no OpenFlamingo (versão de código aberto do Flamingo da DeepMind), treinado no MIMIC-IT, demonstrando melhor capacidade de seguir instruções e aprendizado em contexto.
★ 3.437+2Variação de estrelas nos últimos 7 dias - #4
InternLM-XComposer2.5-OmniLive: Um sistema multimodal abrangente para interações de vídeo e áudio em streaming de longa duração
★ 2.925+1Variação de estrelas nos últimos 7 dias