foundation-models
Erfasste Open-Source-Repos mit dem Tag foundation-models, sortiert nach Sternen.
- #31
Kuratierter visueller Katalog mit über 155 Vision-Language-Modell-Architekturen (VLM/MLLM): Paper, Diagramme, Trainingsrezepte, Datensätze und eine Release-Timeline für multimodale KI-Agenten.
★ 1.310+2Sterne-Änderung der letzten 7 Tage - #32
Lesenswerte Arbeiten zur Wissensbearbeitung für Large Language Models.
★ 1.246-1Sterne-Änderung der letzten 7 Tage - #33
Eine professionelle Liste zu Large Language Models und Foundation Models (LLM, LM, FM) für Zeitreihen-, raumbezogene und Ereignisdaten.
★ 1.222+0Sterne-Änderung der letzten 7 Tage - #34
TorchXRayVision: Eine Bibliothek mit Röntgenthorax-Datensätzen und -Modellen. Klassifizierer, Segmentierung und Autoencoder.
★ 1.188+3Sterne-Änderung der letzten 7 Tage - #35
Ein praktisches Labor zum Erstellen, Testen und Evaluieren von Apps mit dem Foundation Models-Framework von Apple.
★ 1.178+1Sterne-Änderung der letzten 7 Tage - #36
Eine kuratierte Liste von Foundation Models für Bild- und Sprachaufgaben
★ 1.177+0Sterne-Änderung der letzten 7 Tage - #37
Ein allgemeines Repräsentationsmodell über Bild-, Audio- und Sprachmodalitäten. Paper: ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities
★ 1.060+0Sterne-Änderung der letzten 7 Tage - #38
[ECCV 2024 Best Paper Candidate & TPAMI 2025] PointLLM: Befähigung großer Sprachmodelle zum Verständnis von Punktwolken
★ 1.054+3Sterne-Änderung der letzten 7 Tage - #39
Offizieller Code, Datensätze und Checkpoints für „Timer: Generative Pre-trained Transformers Are Large Time Series Models“ (ICML 2024) und nachfolgende Arbeiten
★ 1.014+4Sterne-Änderung der letzten 7 Tage - #40★ 1.014+1Sterne-Änderung der letzten 7 Tage
- #41
[CVPR 2024 🔥] Grounding Large Multimodal Model (GLaMM), das weltweit erste Modell, das natürlichsprachliche Antworten generieren kann, die nahtlos in Objektdegmentierungsmasken integriert sind.
★ 967+0Sterne-Änderung der letzten 7 Tage - #42
Offizielle PyTorch-Implementierung von FasterViT: Fast Vision Transformers with Hierarchical Attention (ICLR 2024)
★ 925+0Sterne-Änderung der letzten 7 Tage - #43
Grundlagenmodelle für Genomik und Transkriptomik
★ 917+5Sterne-Änderung der letzten 7 Tage - #44
Kostenloser und vollständig quelloffener L2-ADAS-Stack, angetrieben durch End-to-End-KI-Technologie
★ 884+15Sterne-Änderung der letzten 7 Tage - #45
Ein Python-Toolkit zur Feinabstimmung von geospatialen Basismodellen (GFMs).
★ 857+5Sterne-Änderung der letzten 7 Tage - #46★ 853+0Sterne-Änderung der letzten 7 Tage
- #47
VoxPoser: Kombinierbare 3D-Wertkarten für die Robotermanipulation mit Sprachmodellen
★ 834+1Sterne-Änderung der letzten 7 Tage - #48★ 833+4Sterne-Änderung der letzten 7 Tage
- #49
Eine kuratierte Liste von 3D-Vision-Papern mit Bezug zur Robotik im Zeitalter großer Modelle wie LLMs/VLMs, inspiriert von awesome-computer-vision, einschließlich Papers, Codes und zugehörigen Websites
★ 822+3Sterne-Änderung der letzten 7 Tage - #50
Offizielle Implementierung von HyenaDNA, einem mit Hyena erstellten Genom-Basismodell für lange Sequenzen
★ 806-2Sterne-Änderung der letzten 7 Tage - #51
[MICCAI 2019 Young Scientist Award] [MEDIA 2020 Best Paper Award] Models Genesis, eines der ersten "Fundament"-Modelle in der medizinischen Bildanalyse für verschiedene Downstream-Tasks
★ 791+1Sterne-Änderung der letzten 7 Tage - #52★ 789+20Sterne-Änderung der letzten 7 Tage
- #53
Modellzusammenführung in LLMs, MLLMs und darüber hinaus: Methoden, Theorien, Anwendungen und Möglichkeiten. ACM Computing Surveys, 2026.
★ 780+2Sterne-Änderung der letzten 7 Tage - #54★ 742+8Sterne-Änderung der letzten 7 Tage
- #55
[CVPR26] TESSERA ist ein Foundation Model, das Satellitenbilder im Zeitverlauf für Anwendungen wie Landklassifizierung und Kronenhöhenvorhersage verarbeiten kann. Es wurde an der University of Cambridge entwickelt und ermöglicht die effiziente Extraktion temporaler Muster aus Erdbeobachtungsdaten.
★ 732+14Sterne-Änderung der letzten 7 Tage - #56★ 685+1Sterne-Änderung der letzten 7 Tage
- #57
HoloMotion: Ein Basismodell für die ganzheitliche Steuerung humanoider Roboter
★ 681+15Sterne-Änderung der letzten 7 Tage - #58
Vision-Grundlagenmodelle für medizinische KI, einschließlich RETFound, DINOv2 und DINOv3.
★ 671+3Sterne-Änderung der letzten 7 Tage - #59
✨✨ Neueste Papers und Benchmarks zum Reasoning mit Foundation Models
★ 657+1Sterne-Änderung der letzten 7 Tage - #60★ 648+1Sterne-Änderung der letzten 7 Tage