Zum Hauptinhalt springen
buildradar
Sign in
Eigentümer · OpenGVLab

OpenGVLab

Erfasste Open-Source-Repos von OpenGVLab, sortiert nach Sternen.

17 Repos
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] InternVL Family: Eine bahnbrechende Open-Source-Alternative zu GPT-4o. Ein Open-Source-Multimodal-Dialogmodell, das der Leistung von GPT-4o nahekommt.

    10.147+6Sterne-Änderung der letzten 7 Tage
  • LLaMA-Adapter@OpenGVLab

    [ICLR 2024] Fine-Tuning von LLaMA zum Befolgen von Anweisungen innerhalb von 1 Stunde und mit 1,2M Parametern

    5.914+0Sterne-Änderung der letzten 7 Tage
  • Ask-Anything@OpenGVLab

    [CVPR2024 Highlight][VideoChatGPT] ChatGPT mit Videoverständnis! Sowie viele weitere unterstützte LMs wie miniGPT4, StableLM und MOSS.

    3.347+0Sterne-Änderung der letzten 7 Tage
  • InternGPT@OpenGVLab

    InternGPT (iGPT) ist eine Open-Source-Demoplattform zur einfachen Präsentation von KI-Modellen. Unterstützt nun DragGAN, ChatGPT, ImageBind, multimodalen Chat wie GPT-4, SAM, interaktive Bildbearbeitung und mehr. Testen Sie es unter igpt.opengvlab.com

    3.205+1Sterne-Änderung der letzten 7 Tage
  • InternImage@OpenGVLab

    [CVPR 2023 Highlight] InternImage: Untersuchung groß angelegter Vision Foundation Models mit deformierbaren Faltungen

    2.841+2Sterne-Änderung der letzten 7 Tage
  • InternVideo@OpenGVLab

    [ECCV2024] Video Foundation Models & Data für multimodales Verständnis

    2.370+4Sterne-Änderung der letzten 7 Tage
  • VisionLLM@OpenGVLab

    VisionLLM-Serie

    1.154+1Sterne-Änderung der letzten 7 Tage
  • SAM-Med2D@OpenGVLab

    Offizielle Implementierung von SAM-Med2D

    1.134+1Sterne-Änderung der letzten 7 Tage
  • ScaleCUA@OpenGVLab

    [ICLR 2026 Oral] ScaleCUA ist ein Open-Source-Agent für Computernutzung, der in plattformübergreifenden Umgebungen (Windows, macOS, Ubuntu, Android) arbeiten kann.

    1.133+3Sterne-Änderung der letzten 7 Tage
  • VideoMamba@OpenGVLab

    [ECCV2024] VideoMamba: State-Space-Modell für effizientes Videoverständnis

    1.125+1Sterne-Änderung der letzten 7 Tage
  • OmniQuant@OpenGVLab

    [ICLR2024 Spotlight] OmniQuant ist eine einfache und leistungsstarke Quantisierungstechnik für LLMs.

    911+3Sterne-Änderung der letzten 7 Tage
  • VideoMAEv2@OpenGVLab

    [CVPR 2023] VideoMAE V2: Skalierung von Video Masked Autoencoders mit Dual Masking

    816+2Sterne-Änderung der letzten 7 Tage
  • DCNv4@OpenGVLab

    [CVPR 2024] Deformable Convolution v4

    746+0Sterne-Änderung der letzten 7 Tage
  • Multi-Modality-Arena@OpenGVLab

    Chatbot Arena trifft auf Multimodalität! Multi-Modality Arena ermöglicht es, Vision-Language-Modelle nebeneinander zu benchmarken, während Bilder als Eingaben bereitgestellt werden. Unterstützt MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 und viele weitere!

    566+0Sterne-Änderung der letzten 7 Tage
  • Vision-RWKV@OpenGVLab

    [ICLR 2025 Spotlight] Vision-RWKV: Effiziente und skalierbare visuelle Wahrnehmung mit RWKV-basierten Architekturen

    556+0Sterne-Änderung der letzten 7 Tage
  • VideoChat-Flash@OpenGVLab

    [ICLR2026] VideoChat-Flash: Hierarchische Kompression für die Modellierung langer Videokontexte.

    528+0Sterne-Änderung der letzten 7 Tage
  • all-seeing@OpenGVLab

    [ICLR 2024 & ECCV 2024] The All-Seeing Projects: Panoptische visuelle Erkennung, Verständnis und allgemeines Beziehungsverständnis in der offenen Welt.

    506+0Sterne-Änderung der letzten 7 Tage
← Zurück zur Eigentümer-Rangliste