OpenGVLab
OpenGVLab の追跡中のオープンソースリポジトリを、スター数順に表示します。
- #1
[CVPR 2024 Oral] InternVL Family: GPT-4oに匹敵する画期的なオープンソース代替モデル。GPT-4oの性能に迫るオープンソースのマルチモーダル対話モデル。
★ 10,147+6直近 7 日のスター増減 - #2
[ICLR 2024] 1時間以内にLLaMAをファインチューニングし、1.2Mのパラメータで指示に従わせる
★ 5,914+0直近 7 日のスター増減 - #3
[CVPR2024 Highlight][VideoChatGPT] 動画理解機能を持つ ChatGPT!miniGPT4、StableLM、MOSS など、他にも多くの LM をサポート。
★ 3,347+0直近 7 日のスター増減 - #4
InternGPT (iGPT) は、AI モデルを簡単に公開できるオープンソースのデモプラットフォームです。DragGAN、ChatGPT、ImageBind、GPT-4 のようなマルチモーダルチャット、SAM、インタラクティブな画像編集などをサポートしています。igpt.opengvlab.com でお試しください。
★ 3,205+1直近 7 日のスター増減 - #5
[CVPR 2023 Highlight] InternImage: 変形可能畳み込みを用いた大規模視覚基盤モデルの探索
★ 2,841+2直近 7 日のスター増減 - #6
[ECCV2024] マルチモーダル理解のためのビデオ基盤モデルとデータ
★ 2,370+4直近 7 日のスター増減 - #7★ 1,154+1直近 7 日のスター増減
- #8★ 1,134+1直近 7 日のスター増減
- #9
[ICLR 2026 Oral] ScaleCUA は、クロスプラットフォーム環境(Windows、macOS、Ubuntu、Android)で動作するオープンソースの computer use agent です。
★ 1,133+3直近 7 日のスター増減 - #10
[ECCV2024] VideoMamba: 効率的な動画理解のための State Space Model
★ 1,125+1直近 7 日のスター増減 - #11★ 911+3直近 7 日のスター増減
- #12
[CVPR 2023] VideoMAE V2: デュアルマスキングを用いたビデオマスクオートエンコーダーのスケーリング
★ 816+2直近 7 日のスター増減 - #13★ 746+0直近 7 日のスター増減
- #14
Chatbot Arena がマルチモーダルと融合!Multi-Modality Arena では、画像を入力として提供しながら、視覚言語モデルを並行してベンチマークできます。MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 などをサポート!
★ 566+0直近 7 日のスター増減 - #15
[ICLR 2025 Spotlight] Vision-RWKV: RWKV ライクなアーキテクチャによる効率的でスケーラブルな視覚的知覚
★ 556+0直近 7 日のスター増減 - #16
[ICLR2026] VideoChat-Flash: 長コンテキストビデオモデリングのための階層的圧縮。
★ 528+0直近 7 日のスター増減 - #17
[ICLR 2024 & ECCV 2024] The All-Seeing Projects: パノプティック視覚認識・理解およびオープンワールドの一般関係理解に向けて
★ 506+0直近 7 日のスター増減