Pular para o conteúdo principal
buildradar
Sign in
Tópico · vla

vla

Repositórios de código aberto acompanhados marcados com vla, ordenados por estrelas.

Repositórios
17
Total de estrelas
18.356
Média de estrelas
1.080
Participação
0,00%

Tópicos que aparecem com frequência ao lado de vla no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com vla.

  • StreamPI@hku-sail

    StreamPI: Streaming Multimodal Temporal Modeling for Vision-Language-Action Models

    172
  • MindPaw@ace-trump-tech

    MindPaw — cão-robô quadrúpede de mesa baseado em ESP8266, com suporte a interação por voz (HLK-V20), reconhecimento de gestos (OV2640+MLP leve), conversação por IA (modelo Doubao), computação afetiva PAD e controle remoto via Wi-Fi. Custo total de materiais ≈¥50, código/PCB/impressão 3D totalmente open source, ideal para iniciantes em robótica, IA embarcada e pesquisa de interação humano-robô (HRI).

    2.463+21Variação de estrelas nos últimos 7 dias
  • alpamayo@NVlabs

    NVIDIA Alpamayo 1 Nano é um modelo VLA de raciocínio aberto de 10B para veículos autônomos que combina trajetórias de direção com raciocínio de Cadeia de Causalidade.

    2.013+6Variação de estrelas nos últimos 7 dias
  • SimpleVLA-RL@PRIME-RL

    [ICLR 2026] SimpleVLA-RL: Escalando o treinamento de VLA via aprendizado por reforço

    1.844+6Variação de estrelas nos últimos 7 dias
  • lingbot-vla@Robbyant

    Um modelo de fundação VLA pragmático

    1.794+11Variação de estrelas nos últimos 7 dias
  • dexbotic@dexmal

    Dexbotic: Caixa de ferramentas de código aberto para visão, linguagem e ação

    1.416+9Variação de estrelas nos últimos 7 dias
  • UniVLA@OpenDriveLab

    [RSS 2025] Aprendendo a agir em qualquer lugar com ações latentes centradas em tarefas

    1.126+1Variação de estrelas nos últimos 7 dias
  • InternNav@InternRobotics

    Plataforma aberta da InternRobotics para construir modelos fundamentais de navegação generalizada.

    1.090+18Variação de estrelas nos últimos 7 dias
  • OpenWorldLib@OpenDCAI

    Base de código unificada para Modelos de Mundo Avançados.

    866+2Variação de estrelas nos últimos 7 dias
  • FSDrive@MIV-XJTU

    [Destaque NeurIPS 2025] Implementação oficial de "FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving"

    831+9Variação de estrelas nos últimos 7 dias
  • 🚀🚀🚀Uma coleção de projetos públicos incríveis sobre Modelos de Linguagem de Grande Escala (LLM), Modelos de Visão e Linguagem (VLM), Visão, Linguagem e Ação (VLA), Conteúdo Gerado por IA (AIGC), além de conjuntos de dados e aplicativos relacionados.

    815+1Variação de estrelas nos últimos 7 dias
  • SpatialVLA@SpatialVLA

    🔥 SpatialVLA: um modelo de visão-linguagem-ação aprimorado espacialmente, treinado em 1,1 milhão de episódios de robôs reais. Aceito no RSS 2025.

    718+1Variação de estrelas nos últimos 7 dias
  • realtime-vla@dexmal

    Executando VLA a uma taxa de quadros de 30Hz e frequência de trajetória de 480Hz.

    611+2Variação de estrelas nos últimos 7 dias
  • VLA-Handbook@sou350121

    Este projeto visa fornecer um manual de aprendizado e entrevista totalmente em chinês e orientado à prática para engenheiros de algoritmos dedicados a entrar no campo de VLA (Visão-Linguagem-Ação). Diferente dos guias de entrevista gerais de CV/NLP, este projeto foca nos desafios específicos da Robótica.

    591+33Variação de estrelas nos últimos 7 dias
  • JanusVLN@MIV-XJTU

    [ICLR2026] Implementação oficial para "JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation"

    588+4Variação de estrelas nos últimos 7 dias
  • FlashRT@flashrt-project

    FlashRT é um motor de inferência em tempo real de alto desempenho para cargas de trabalho de IA de lote pequeno e sensíveis à latência. A integração principal é o controle VLA de produção para Pi0, Pi0.5, GROOT N1.6 e Pi0-FAST. Também suporta LLM, por exemplo, qwen3.6-27B

    550+11Variação de estrelas nos últimos 7 dias
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    549+15Variação de estrelas nos últimos 7 dias
  • DeepThinkVLA@OpenBMB

    DeepThinkVLA: Aprimorando a capacidade de raciocínio de modelos de visão-linguagem-ação

    529+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos