メインコンテンツへスキップ
buildradar
Sign in
オーナー · FoundationVision

FoundationVision

FoundationVision の追跡中のオープンソースリポジトリを、スター数順に表示します。

10 件のリポジトリ
  • VAR@FoundationVision

    [NeurIPS 2024 Best Paper Award][GPT beats diffusion🔥] [visual generationにおけるスケーリング則📈] 「Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction」の公式実装。自己回帰型画像生成のための*超シンプルでユーザーフレンドリーながら最先端*のコードベース!

    8,728-1直近 7 日のスター増減
  • ByteTrack@FoundationVision

    [ECCV 2022] ByteTrack: 全ての検出ボックスを関連付けることによるマルチオブジェクトトラッキング。

    6,662+4直近 7 日のスター増減
  • LlamaGen@FoundationVision

    自己回帰モデルが Diffusion を凌駕:スケーラブルな画像生成のための 🦙 Llama

    1,966+0直近 7 日のスター増減
  • Infinity@FoundationVision

    [CVPR 2025 Oral]Infinity ∞ : 高解像度画像合成に向けたビットワイズ自己回帰モデリングのスケーリング

    1,587+0直近 7 日のスター増減
  • GLEE@FoundationVision

    [CVPR2024 Highlight]GLEE: 大規模画像・動画のための汎用物体基礎モデル

    1,170+0直近 7 日のスター増減
  • Waver@FoundationVision

    テキストからの動画生成 (T2V) と画像からの動画生成 (I2V) を統合した、産業レベルの動画基盤モデル。

    952+0直近 7 日のスター増減
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral]Infinity⭐️: 視覚生成のための統合時空間自己回帰モデリング

    783+4直近 7 日のスター増減
  • Liquid@FoundationVision

    (IJCV 採択)Liquid:スケーラブルで統合されたマルチモーダルジェネレータとしての言語モデル

    640+0直近 7 日のスター増減
  • Groma@FoundationVision

    [ECCV2024] 局所化されたビジュアルトークン化を備えたグラウンデッドマルチモーダル大規模言語モデル

    586+0直近 7 日のスター増減
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] 視覚生成と理解のための統合トークナイザー

    529+0直近 7 日のスター増減
← オーナーランキングに戻る