vla
Repositorios de código abierto monitorizados etiquetados con vla, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a vla en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con vla.
- #1
🐕 MindPaw — Perro robot cuadrúpedo de escritorio basado en ESP8266, compatible con interacción por voz (HLK-V20), reconocimiento de gestos (OV2640 + MLP ligero), chat de IA (modelo Doubao), computación afectiva en PAD y control remoto web por WiFi. Costo total de materiales ≈¥50, código/PCB/impresión 3D totalmente de código abierto, ideal para iniciación en robótica, IA embebida e investigación de interacción afectiva HRI.
★ 2458+37Variación de estrellas de los últimos 7 días - #2
NVIDIA Alpamayo 1 Nano es un modelo VLA de razonamiento abierto de 10B para vehículos autónomos que combina trayectorias de conducción con razonamiento de cadena de causalidad.
★ 2010+8Variación de estrellas de los últimos 7 días - #3
[ICLR 2026] SimpleVLA-RL: Escalado del entrenamiento de VLA mediante aprendizaje por refuerzo.
★ 1841+9Variación de estrellas de los últimos 7 días - #4
Un modelo fundacional VLA pragmático.
★ 1792+19Variación de estrellas de los últimos 7 días - #5★ 1410+13Variación de estrellas de los últimos 7 días
- #6
[RSS 2025] Aprender a actuar en cualquier lugar con acciones latentes centradas en la tarea.
★ 1126+4Variación de estrellas de los últimos 7 días - #7
Plataforma abierta de InternRobotics para construir modelos base de navegación generalizada.
★ 1081+19Variación de estrellas de los últimos 7 días - #8
Base de código unificada para modelos de mundo avanzados.
★ 864+4Variación de estrellas de los últimos 7 días - #9
[NeurIPS 2025 spotlight] Implementación oficial de "FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving".
★ 826+1Variación de estrellas de los últimos 7 días - #10
Una colección de proyectos públicos sobre modelos de lenguaje extensos (LLM), modelos de lenguaje visual (VLM), acción de lenguaje visual (VLA), contenido generado por IA (AIGC), y sus conjuntos de datos y aplicaciones relacionados.
★ 814+0Variación de estrellas de los últimos 7 días - #11
SpatialVLA: un modelo de visión-lenguaje-acción con mejora espacial entrenado en 1.1 millones de episodios de robots reales. Aceptado en RSS 2025.
★ 717+2Variación de estrellas de los últimos 7 días - #12
Ejecución de VLA a una tasa de 30 fotogramas por segundo y una frecuencia de trayectoria de 480Hz
★ 609+5Variación de estrellas de los últimos 7 días - #13
[ICLR2026] Implementación oficial de "JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation"
★ 587+4Variación de estrellas de los últimos 7 días - #14
Este proyecto tiene como objetivo proporcionar un manual de aprendizaje y entrevistas práctico y totalmente en chino para ingenieros de algoritmos dedicados al campo de VLA (Visión-Lenguaje-Acción). A diferencia de las guías generales de CV/NLP, este proyecto se centra en los desafíos específicos de la robótica.
★ 574+28Variación de estrellas de los últimos 7 días - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 544—Variación de estrellas de los últimos 7 días - #16
FlashRT es un motor de inferencia en tiempo real de alto rendimiento para cargas de trabajo de IA de lotes pequeños y sensibles a la latencia. Su integración principal es el control VLA de producción para Pi0, Pi0.5, GROOT N1.6 y Pi0-FAST. También admite LLM como qwen3.6-27B.
★ 538+16Variación de estrellas de los últimos 7 días - #17
DeepThinkVLA: Mejora de la capacidad de razonamiento de los modelos de visión-lenguaje-acción.
★ 529+2Variación de estrellas de los últimos 7 días