vla
Erfasste Open-Source-Repos mit dem Tag vla, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit vla am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit vla getaggt wurden.
- #1
🐕 MindPaw — Ein ESP8266-basierter Desktop-Vierbeiner-Roboterhund mit Sprachinteraktion (HLK-V20), Gestenerkennung (OV2640 + leichtgewichtige MLP), KI-Dialog (Doubao-Modell), PAD-Emotionsberechnung und WiFi-Web-Fernsteuerung. Gesamte Materialkosten ca. 50 ¥, Code/PCB/3D-Druck vollständig Open Source, ideal für Robotikeinstieg, Embedded-KI und HRI-Emotionsinteraktionsforschung.
★ 2.463+34Sterne-Änderung der letzten 7 Tage - #2
NVIDIA Alpamayo 1 Nano ist ein offenes 10B-Reasoning-VLA-Modell für autonome Fahrzeuge, das Fahrbahnen mit Chain-of-Causation-Reasoning verknüpft.
★ 2.013+8Sterne-Änderung der letzten 7 Tage - #3
[ICLR 2026] SimpleVLA-RL: Skalierung des VLA-Trainings durch Reinforcement Learning
★ 1.844+10Sterne-Änderung der letzten 7 Tage - #4
Ein pragmatisches VLA-Grundlagenmodell
★ 1.794+15Sterne-Änderung der letzten 7 Tage - #5★ 1.416+12Sterne-Änderung der letzten 7 Tage
- #6
[RSS 2025] Lernen, überall zu handeln, mithilfe aufgabenzentrierter latenter Aktionen
★ 1.126+2Sterne-Änderung der letzten 7 Tage - #7
InternRobotics' offene Plattform zum Erstellen verallgemeinerter Navigations-Fundamentmodelle.
★ 1.090+24Sterne-Änderung der letzten 7 Tage - #8
Einheitliche Codebasis für fortschrittliche Weltmodelle.
★ 866+1Sterne-Änderung der letzten 7 Tage - #9
[NeurIPS 2025 Spotlight] Offizielle Implementierung für „FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving“
★ 831+6Sterne-Änderung der letzten 7 Tage - #10
🚀🚀🚀 Eine Sammlung großartiger öffentlicher Projekte zu Large Language Models (LLM), Vision Language Models (VLM), Vision Language Action (VLA), AI Generated Content (AIGC) sowie den zugehörigen Datensätzen und Anwendungen.
★ 815+0Sterne-Änderung der letzten 7 Tage - #11
SpatialVLA: Ein räumlich erweitetes Vision-Language-Action-Modell, trainiert mit 1,1 Millionen realen Roboter-Episoden. Angenommen bei RSS 2025.
★ 718+1Sterne-Änderung der letzten 7 Tage - #12
Ausführung von VLA mit einer Bildrate von 30 Hz und einer Trajektorienfrequenz von 480 Hz
★ 611+2Sterne-Änderung der letzten 7 Tage - #13
Dieses Projekt bietet Algorithmen-Ingenieuren, die in den Bereich VLA (Vision-Language-Action) einsteigen möchten, ein praxisorientiertes Lern- und Interview-Handbuch. Im Gegensatz zu allgemeinen CV/NLP-Leitfäden konzentriert sich dieses Projekt auf die spezifischen Herausforderungen der Robotik.
★ 591+31Sterne-Änderung der letzten 7 Tage - #14
[ICLR2026] Offizielle Implementierung für "JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation".
★ 588+4Sterne-Änderung der letzten 7 Tage - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+17Sterne-Änderung der letzten 7 Tage - #16
FlashRT ist eine leistungsstarke Echtzeit-Inferenz-Engine für KI-Workloads mit kleinen Batches und geringer Latenz. Die Hauptintegration umfasst die VLA-Steuerung für Pi0, Pi0.5, GROOT N1.6 und Pi0-FAST sowie Unterstützung für LLMs wie Qwen3.6-27B.
★ 546+9Sterne-Änderung der letzten 7 Tage - #17
DeepThinkVLA: Verbesserung der Schlussfolgerungsfähigkeit von Vision-Language-Action-Modellen
★ 529+1Sterne-Änderung der letzten 7 Tage