メインコンテンツへスキップ
buildradar
Sign in
トピック · vla

vla

vla がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
17
総スター数
18,240
平均スター数
1,073
シェア
0.00%

vla と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、vla がタグ付けされたリポジトリ。

  • StreamPI@hku-sail

    StreamPI: Streaming Multimodal Temporal Modeling for Vision-Language-Action Models

    164
  • MindPaw@ace-trump-tech

    🐕 MindPaw — ESP8266 をベースにしたデスクトップ型 4 足歩行ロボット犬。音声対話 (HLK-V20)、ジェスチャー認識 (OV2640+軽量 MLP)、AI 対話 (豆包大模型)、PAD 感情計算、WiFi Web リモコンをサポート。総部品コストは約 50 元、コード/PCB/3D プリントはすべてオープンソースで、ロボット入門、組み込み AI、HRI 感情インタラクションの研究に最適。

    2,458+37直近 7 日のスター増減
  • alpamayo@NVlabs

    NVIDIA Alpamayo 1 Nanoは、走行軌跡とChain-of-Causation推論を組み合わせた、自動運転車向けのオープンな10B推論VLAモデルです。

    2,010+8直近 7 日のスター増減
  • SimpleVLA-RL@PRIME-RL

    [ICLR 2026] SimpleVLA-RL: 強化学習による VLA トレーニングのスケーリング

    1,841+9直近 7 日のスター増減
  • lingbot-vla@Robbyant

    実用的なVLA基盤モデル

    1,792+19直近 7 日のスター増減
  • dexbotic@dexmal

    Dexbotic: オープンソースのVision-Language-Actionツールボックス

    1,410+13直近 7 日のスター増減
  • UniVLA@OpenDriveLab

    [RSS 2025] タスク中心の潜在アクションを用いた、あらゆる場所での行動学習

    1,126+4直近 7 日のスター増減
  • InternNav@InternRobotics

    汎用ナビゲーション基盤モデル構築のためのInternRoboticsのオープンプラットフォーム

    1,081+19直近 7 日のスター増減
  • OpenWorldLib@OpenDCAI

    高度なワールドモデルのための統合コードベース。

    864+4直近 7 日のスター増減
  • FSDrive@MIV-XJTU

    「FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving」の公式実装 (NeurIPS 2025 スポットライト採択)

    826+1直近 7 日のスター増減
  • 🚀🚀🚀 大規模言語モデル(LLM)、視覚言語モデル(VLM)、視覚言語行動モデル(VLA)、AI生成コンテンツ(AIGC)、および関連するデータセットやアプリケーションに関する素晴らしい公開プロジェクトのコレクション。

    814+0直近 7 日のスター増減
  • SpatialVLA@SpatialVLA

    🔥 SpatialVLA: 110万件の実ロボットエピソードでトレーニングされた、空間拡張ビジョン・言語・行動モデル。RSS 2025採択。

    717+2直近 7 日のスター増減
  • realtime-vla@dexmal

    30Hzのフレームレートと480Hzの軌道周波数でのVLAの実行

    609+5直近 7 日のスター増減
  • JanusVLN@MIV-XJTU

    [ICLR2026] 「JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation」の公式実装

    586+4直近 7 日のスター増減
  • VLA-Handbook@sou350121

    本プロジェクトは、VLA(Vision-Language-Action)分野を目指すアルゴリズムエンジニア向けに、完全中国語による実践指向の学習・面接ハンドブックを提供することを目的としています。一般的なCV/NLPの面接ガイドとは異なり、ロボティクス特有の課題に焦点を当てています。

    569+28直近 7 日のスター増減
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    544直近 7 日のスター増減
  • FlashRT@flashrt-project

    FlashRTは、小バッチかつ低レイテンシが求められるAIワークロード向けの高性能リアルタイム推論エンジンです。主な統合機能として、Pi0、Pi0.5、GROOT N1.6、Pi0-FASTのプロダクションVLA制御をサポートします。また、qwen3.6-27BなどのLLMもサポートしています。

    538+16直近 7 日のスター増減
  • DeepThinkVLA@OpenBMB

    DeepThinkVLA:視覚・言語・行動(VLA)モデルの推論能力の向上

    529+2直近 7 日のスター増減
← トピック一覧に戻る