vla
Repositórios de código aberto acompanhados marcados com vla, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de vla no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com vla.
- #1
MindPaw — cão-robô quadrúpede de mesa baseado em ESP8266, com suporte a interação por voz (HLK-V20), reconhecimento de gestos (OV2640+MLP leve), conversação por IA (modelo Doubao), computação afetiva PAD e controle remoto via Wi-Fi. Custo total de materiais ≈¥50, código/PCB/impressão 3D totalmente open source, ideal para iniciantes em robótica, IA embarcada e pesquisa de interação humano-robô (HRI).
★ 2.463+21Variação de estrelas nos últimos 7 dias - #2
NVIDIA Alpamayo 1 Nano é um modelo VLA de raciocínio aberto de 10B para veículos autônomos que combina trajetórias de direção com raciocínio de Cadeia de Causalidade.
★ 2.013+6Variação de estrelas nos últimos 7 dias - #3
[ICLR 2026] SimpleVLA-RL: Escalando o treinamento de VLA via aprendizado por reforço
★ 1.844+6Variação de estrelas nos últimos 7 dias - #4
Um modelo de fundação VLA pragmático
★ 1.794+11Variação de estrelas nos últimos 7 dias - #5★ 1.416+9Variação de estrelas nos últimos 7 dias
- #6
[RSS 2025] Aprendendo a agir em qualquer lugar com ações latentes centradas em tarefas
★ 1.126+1Variação de estrelas nos últimos 7 dias - #7
Plataforma aberta da InternRobotics para construir modelos fundamentais de navegação generalizada.
★ 1.090+18Variação de estrelas nos últimos 7 dias - #8
Base de código unificada para Modelos de Mundo Avançados.
★ 866+2Variação de estrelas nos últimos 7 dias - #9
[Destaque NeurIPS 2025] Implementação oficial de "FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving"
★ 831+9Variação de estrelas nos últimos 7 dias - #10
🚀🚀🚀Uma coleção de projetos públicos incríveis sobre Modelos de Linguagem de Grande Escala (LLM), Modelos de Visão e Linguagem (VLM), Visão, Linguagem e Ação (VLA), Conteúdo Gerado por IA (AIGC), além de conjuntos de dados e aplicativos relacionados.
★ 815+1Variação de estrelas nos últimos 7 dias - #11
🔥 SpatialVLA: um modelo de visão-linguagem-ação aprimorado espacialmente, treinado em 1,1 milhão de episódios de robôs reais. Aceito no RSS 2025.
★ 718+1Variação de estrelas nos últimos 7 dias - #12
Executando VLA a uma taxa de quadros de 30Hz e frequência de trajetória de 480Hz.
★ 611+2Variação de estrelas nos últimos 7 dias - #13
Este projeto visa fornecer um manual de aprendizado e entrevista totalmente em chinês e orientado à prática para engenheiros de algoritmos dedicados a entrar no campo de VLA (Visão-Linguagem-Ação). Diferente dos guias de entrevista gerais de CV/NLP, este projeto foca nos desafios específicos da Robótica.
★ 591+33Variação de estrelas nos últimos 7 dias - #14
[ICLR2026] Implementação oficial para "JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation"
★ 588+4Variação de estrelas nos últimos 7 dias - #15
FlashRT é um motor de inferência em tempo real de alto desempenho para cargas de trabalho de IA de lote pequeno e sensíveis à latência. A integração principal é o controle VLA de produção para Pi0, Pi0.5, GROOT N1.6 e Pi0-FAST. Também suporta LLM, por exemplo, qwen3.6-27B
★ 550+11Variação de estrelas nos últimos 7 dias - #16
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Variação de estrelas nos últimos 7 dias - #17
DeepThinkVLA: Aprimorando a capacidade de raciocínio de modelos de visão-linguagem-ação
★ 529+0Variação de estrelas nos últimos 7 dias