vla
Repositori open source terpantau bertanda vla, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan vla di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda vla.
- #1
MindPaw — Robot anjing berkaki empat berbasis ESP8266 untuk desktop, mendukung interaksi suara (HLK-V20), pengenalan gestur (OV2640+MLP ringan), AI percakapan (model Doubao), komputasi emosi PAD, dan kendali jarak jauh via WiFi. Total biaya material ≈¥50, kode/PCB/cetak 3D sepenuhnya open source, cocok untuk pemula robotika, AI tertanam, dan riset interaksi emosional HRI.
★ 2.449+37Perubahan bintang dalam 7 hari terakhir - #2
NVIDIA Alpamayo 1 Nano adalah model VLA penalaran 10B terbuka untuk kendaraan otonom yang memadukan lintasan mengemudi dengan penalaran Chain-of-Causation.
★ 2.008+8Perubahan bintang dalam 7 hari terakhir - #3
[ICLR 2026] SimpleVLA-RL: Menskalakan pelatihan VLA melalui Reinforcement Learning
★ 1.839+9Perubahan bintang dalam 7 hari terakhir - #4
Model dasar VLA yang pragmatis
★ 1.785+19Perubahan bintang dalam 7 hari terakhir - #5★ 1.407+13Perubahan bintang dalam 7 hari terakhir
- #6
[RSS 2025] Belajar bertindak di mana saja dengan tindakan laten yang berpusat pada tugas
★ 1.125+4Perubahan bintang dalam 7 hari terakhir - #7★ 1.074+19Perubahan bintang dalam 7 hari terakhir
- #8
Basis kode terpadu untuk World Models tingkat lanjut.
★ 864+4Perubahan bintang dalam 7 hari terakhir - #9
[Sorotan NeurIPS 2025] Implementasi resmi untuk "FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving"
★ 822+1Perubahan bintang dalam 7 hari terakhir - #10
🚀🚀🚀Kumpulan beberapa proyek publik hebat tentang Large Language Model (LLM), Vision Language Model (VLM), Vision Language Action (VLA), AI Generated Content (AIGC), serta Dataset dan Aplikasi terkait.
★ 814+0Perubahan bintang dalam 7 hari terakhir - #11
🔥 SpatialVLA: model vision-language-action yang disempurnakan secara spasial dan dilatih pada 1,1 Juta episode robot nyata. Diterima di RSS 2025.
★ 717+2Perubahan bintang dalam 7 hari terakhir - #12
Menjalankan VLA pada frame rate 30Hz dan frekuensi lintasan 480Hz.
★ 609+5Perubahan bintang dalam 7 hari terakhir - #13
[ICLR2026] Implementasi resmi untuk "JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation"
★ 586+4Perubahan bintang dalam 7 hari terakhir - #14
Proyek ini bertujuan untuk menyediakan manual pembelajaran/wawancara berbahasa Mandarin yang berorientasi pada praktik bagi para insinyur algoritma yang ingin memasuki bidang VLA (Vision-Language-Action). Berbeda dengan panduan wawancara CV/NLP umum, proyek ini berfokus pada tantangan unik Robotics.
★ 569+28Perubahan bintang dalam 7 hari terakhir - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 540—Perubahan bintang dalam 7 hari terakhir - #16
FlashRT adalah mesin inferensi waktu nyata berkinerja tinggi untuk beban kerja AI batch kecil yang sensitif terhadap latensi. Integrasi utamanya adalah kontrol VLA produksi untuk Pi0, Pi0.5, GROOT N1.6, dan Pi0-FAST. Juga mendukung LLM seperti qwen3.6-27B
★ 538+16Perubahan bintang dalam 7 hari terakhir - #17
DeepThinkVLA: Meningkatkan Kemampuan Penalaran Model Vision-Language-Action
★ 529+2Perubahan bintang dalam 7 hari terakhir