vit
Erfasste Open-Source-Repos mit dem Tag vit, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit vit am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit vit getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
pix2tex: Verwendung eines ViT zur Umwandlung von Gleichungsbildern in LaTeX-Code.
★ 16.549+5Sterne-Änderung der letzten 7 Tage - #2
Eine äußerst umfassende Liste von Arbeiten zu Vision Transformer/Attention, einschließlich Papern, Codes und zugehörigen Websites
★ 5.049+0Sterne-Änderung der letzten 7 Tage - #3
Open-Source-Evaluierungs-Toolkit für Large Multi-Modality Models (LMMs), unterstützt über 220 LMMs und 80+ Benchmarks
★ 4.362+10Sterne-Änderung der letzten 7 Tage - #4
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention erzielt eine 2- bis 5-fache Beschleunigung im Vergleich zu FlashAttention, ohne Einbußen bei End-to-End-Metriken über Sprach-, Bild- und Videomodelle hinweg.
★ 3.685+23Sterne-Änderung der letzten 7 Tage - #5
Towhee ist ein Framework, das darauf ausgerichtet ist, Pipelines zur Verarbeitung neuronaler Daten einfach und schnell zu machen.
★ 3.454+0Sterne-Änderung der letzten 7 Tage - #6
Verwandeln Sie jeden Computer oder Edge-Device in ein Kommandozentrum für Ihre Computer-Vision-Projekte.
★ 2.429+5Sterne-Änderung der letzten 7 Tage - #7
[CVPR 2021] Offizielle PyTorch-Implementierung für Transformer Interpretability Beyond Attention Visualization, eine neuartige Methode zur Visualisierung von Klassifikationen durch Transformer-basierte Netzwerke.
★ 2.014+0Sterne-Änderung der letzten 7 Tage - #8
Eine Literaturliste zu einigen aktuellen Transformer-basierten CV-Arbeiten.
★ 1.464+0Sterne-Änderung der letzten 7 Tage - #9
[ICML2025] SpargeAttention: Eine trainingsfreie sparse Attention, die die Inferenz beliebiger Modelle beschleunigt.
★ 1.042+12Sterne-Änderung der letzten 7 Tage - #10
Adan: Adaptiver Nesterov-Momentum-Algorithmus für eine schnellere Optimierung von Deep-Modellen
★ 822+0Sterne-Änderung der letzten 7 Tage - #11
Extrahieren von Videofunktionen aus Rohvideos unter Verwendung mehrerer GPUs. Wir unterstützen RAFT-Flow-Frames sowie S3D-, I3D-, R(2+1)D-, VGGish-, CLIP- und TIMM-Modelle.
★ 655+0Sterne-Änderung der letzten 7 Tage - #12
[CVPR 2025 Highlight] Offizieller Code und Modelle für Encoder-only Mask Transformer (EoMT).
★ 620+0Sterne-Änderung der letzten 7 Tage