OpenGVLab
Dépôts open source suivis de OpenGVLab, triés par étoiles.
- #1
[CVPR 2024 Oral] Famille InternVL : Une alternative open source pionnière à GPT-4o
★ 10 147+6Évolution des étoiles sur les 7 derniers jours - #2
[ICLR 2024] Fine-tuning de LLaMA pour suivre des instructions en moins d'une heure et avec 1,2 million de paramètres
★ 5 914+0Évolution des étoiles sur les 7 derniers jours - #3
[CVPR2024 Highlight][VideoChatGPT] ChatGPT avec compréhension vidéo ! Supporte également de nombreux autres modèles de langage tels que miniGPT4, StableLM et MOSS.
★ 3 347+0Évolution des étoiles sur les 7 derniers jours - #4
InternGPT (iGPT) est une plateforme de démonstration open source pour présenter facilement vos modèles d'IA. Prend désormais en charge DragGAN, ChatGPT, ImageBind, le chat multimodal type GPT-4, SAM, l'édition d'image interactive, etc. Essayez-le sur igpt.opengvlab.com
★ 3 205+1Évolution des étoiles sur les 7 derniers jours - #5
[CVPR 2023 Highlight] InternImage : Exploration de modèles de vision à grande échelle avec des convolutions déformables
★ 2 841+2Évolution des étoiles sur les 7 derniers jours - #6
[ECCV2024] Modèles de fondation vidéo et données pour la compréhension multimodale.
★ 2 370+4Évolution des étoiles sur les 7 derniers jours - #7★ 1 154+1Évolution des étoiles sur les 7 derniers jours
- #8★ 1 134+1Évolution des étoiles sur les 7 derniers jours
- #9
[ICLR 2026 Oral] ScaleCUA est un agent d'utilisation informatique open source capable d'opérer dans des environnements multiplateformes (Windows, macOS, Ubuntu, Android).
★ 1 133+3Évolution des étoiles sur les 7 derniers jours - #10
[ECCV2024] VideoMamba : modèle d'espace d'état pour une compréhension vidéo efficace
★ 1 125+1Évolution des étoiles sur les 7 derniers jours - #11
[ICLR2024 spotlight] OmniQuant est une technique de quantification simple et puissante pour les LLM.
★ 911+3Évolution des étoiles sur les 7 derniers jours - #12
[CVPR 2023] VideoMAE V2 : Mise à l'échelle des Video Masked Autoencoders avec double masquage
★ 816+2Évolution des étoiles sur les 7 derniers jours - #13★ 746+0Évolution des étoiles sur les 7 derniers jours
- #14
Chatbot Arena rencontre la multimodalité ! Multi-Modality Arena vous permet d'évaluer des modèles vision-langage côte à côte en fournissant des images en entrée. Prend en charge MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 et bien d'autres !
★ 566+0Évolution des étoiles sur les 7 derniers jours - #15
[ICLR 2025 Spotlight] Vision-RWKV : Perception visuelle efficace et évolutive avec des architectures de type RWKV
★ 556+0Évolution des étoiles sur les 7 derniers jours - #16
[ICLR2026] VideoChat-Flash : compression hiérarchique pour la modélisation vidéo à long contexte
★ 528+0Évolution des étoiles sur les 7 derniers jours - #17
[ICLR 2024 & ECCV 2024] Projets All-Seeing : Vers une reconnaissance et une compréhension visuelle panoptique ainsi qu'une compréhension relationnelle générale en milieu ouvert.
★ 506+0Évolution des étoiles sur les 7 derniers jours