Osilly/Vision-R1
@Osilly[ICLR2026] Este é o primeiro artigo a explorar como usar efetivamente RL estilo R1 para MLLMs e apresenta o Vision-R1, um MLLM de raciocínio que utiliza inicialização a frio e treinamento por RL para incentivar a capacidade de raciocínio.
Estrelas
1.571
Bifurcações
27
Linguagem
Python
Licença
—
Último push
há 5 meses
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.