vision-language-action
Repositorios de código abierto monitorizados etiquetados con vision-language-action, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a vision-language-action en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con vision-language-action.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Mano-P: Agente GUI-VLA de código abierto para dispositivos edge. N.º 1 en OSWorld (especializado, 58.2%). Se ejecuta localmente en Mac mini/MacBook con Apple M4; ningún dato sale de tu dispositivo. Mano-P es un proyecto GUI-VLA de código abierto que admite la inferencia ejecutada localmente en Mac mini/MacBook o a través de aceleradores de cálculo, logrando operaciones de automatización de GUI multiplataforma impulsadas puramente por visión. Los datos se procesan completamente de forma local, admitiendo la planificación y ejecución de tareas complejas de múltiples pasos.
★ 2615+15Variación de estrellas de los últimos 7 días - #2
NVIDIA Alpamayo 1 Nano es un modelo VLA de razonamiento abierto de 10B para vehículos autónomos que combina trayectorias de conducción con razonamiento de cadena de causalidad.
★ 2013+6Variación de estrellas de los últimos 7 días - #3
[CVPR 2025] Modelo Vision-Language-Action de código abierto y de extremo a extremo para GUI Agent y uso de computadoras.
★ 1896+2Variación de estrellas de los últimos 7 días - #4
[NeurIPS 2025] AutoVLA: Un modelo de visión-lenguaje-acción para conducción autónoma de extremo a extremo con razonamiento adaptativo y ajuste fino por refuerzo.
★ 640+6Variación de estrellas de los últimos 7 días - #5
[ICLR 2026] ReCogDrive: Un framework cognitivo reforzado para la conducción autónoma de extremo a extremo
★ 599+4Variación de estrellas de los últimos 7 días - #6
Este proyecto tiene como objetivo proporcionar un manual de aprendizaje y entrevistas práctico y totalmente en chino para ingenieros de algoritmos dedicados al campo de VLA (Visión-Lenguaje-Acción). A diferencia de las guías generales de CV/NLP, este proyecto se centra en los desafíos específicos de la robótica.
★ 594+33Variación de estrellas de los últimos 7 días - #7
[ICLR 2026] Hacia un VLA latente unificado para el control de locomoción y manipulación de cuerpo completo
★ 561+8Variación de estrellas de los últimos 7 días