vision-language-action-model
Repositórios de código aberto acompanhados marcados com vision-language-action-model, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de vision-language-action-model no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com vision-language-action-model.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
StarVLA: Uma base de código modular para o desenvolvimento de modelos de Visão-Linguagem-Ação
★ 3.584+40Variação de estrelas nos últimos 7 dias - #2
Apenas com conhecimentos básicos de Python, construa seu próprio robô de inteligência incorporada do zero; construa gradualmente VLA/OpenVLA/SmolVLA/Pi0 do zero, compreenda profundamente a inteligência incorporada
★ 3.491+88Variação de estrelas nos últimos 7 dias - #3
[Finalista do prêmio de melhor artigo no IROS 2025 e IEEE TRO 2026] Plataforma de manipulação em larga escala para sistemas incorporados inteligentes e escaláveis.
★ 3.163+4Variação de estrelas nos últimos 7 dias - #4
VLA-Adapter: Um paradigma eficaz para modelos de visão-linguagem-ação de pequena escala
★ 2.301+5Variação de estrelas nos últimos 7 dias - #5
Uma lista selecionada de recursos incríveis sobre LLM/VLM/VLA/World Model para Condução Autônoma (LLM4AD) (atualizada continuamente).
★ 1.890-2Variação de estrelas nos últimos 7 dias - #6★ 1.260+11Variação de estrelas nos últimos 7 dias
- #7
Uma lista abrangente de artigos sobre manipulação de robôs, incluindo artigos, códigos e sites relacionados.
★ 1.123+13Variação de estrelas nos últimos 7 dias - #8
Plataforma aberta da InternRobotics para construir modelos fundamentais de navegação generalizada.
★ 1.090+18Variação de estrelas nos últimos 7 dias - #9
[AAAI 2026] OpenDriveVLA: rumo à condução autônoma de ponta a ponta com um modelo de ação de visão-linguagem de grande escala
★ 801+5Variação de estrelas nos últimos 7 dias - #10
[ICLR 2026] A implementação oficial de "Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model"
★ 726+5Variação de estrelas nos últimos 7 dias - #11
Uma plataforma de engenharia VLA all-in-one para IA incorporada — dos dados à implantação em robôs reais.
★ 655+15Variação de estrelas nos últimos 7 dias - #12
[IJCV 2026] Senna: Unindo Grandes Modelos de Visão-Linguagem e Direção Autônoma de Ponta a Ponta
★ 555+1Variação de estrelas nos últimos 7 dias - #13
InternVLA-A1: Unificando compreensão, geração e ação para manipulação robótica.
★ 551+6Variação de estrelas nos últimos 7 dias