Zum Hauptinhalt springen
buildradar
Sign in
Thema · foundation-models

foundation-models

Erfasste Open-Source-Repos mit dem Tag foundation-models, sortiert nach Sternen.

74 Repos
  • Kuratierter visueller Katalog mit über 155 Vision-Language-Modell-Architekturen (VLM/MLLM): Paper, Diagramme, Trainingsrezepte, Datensätze und eine Release-Timeline für multimodale KI-Agenten.

    1.310+2Sterne-Änderung der letzten 7 Tage
  • Lesenswerte Arbeiten zur Wissensbearbeitung für Large Language Models.

    1.246-1Sterne-Änderung der letzten 7 Tage
  • Eine professionelle Liste zu Large Language Models und Foundation Models (LLM, LM, FM) für Zeitreihen-, raumbezogene und Ereignisdaten.

    1.222+0Sterne-Änderung der letzten 7 Tage
  • torchxrayvision@mlmed

    TorchXRayVision: Eine Bibliothek mit Röntgenthorax-Datensätzen und -Modellen. Klassifizierer, Segmentierung und Autoencoder.

    1.188+3Sterne-Änderung der letzten 7 Tage
  • Ein praktisches Labor zum Erstellen, Testen und Evaluieren von Apps mit dem Foundation Models-Framework von Apple.

    1.178+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Foundation Models für Bild- und Sprachaufgaben

    1.177+0Sterne-Änderung der letzten 7 Tage
  • ONE-PEACE@OFA-Sys

    Ein allgemeines Repräsentationsmodell über Bild-, Audio- und Sprachmodalitäten. Paper: ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

    1.060+0Sterne-Änderung der letzten 7 Tage
  • PointLLM@InternRobotics

    [ECCV 2024 Best Paper Candidate & TPAMI 2025] PointLLM: Befähigung großer Sprachmodelle zum Verständnis von Punktwolken

    1.054+3Sterne-Änderung der letzten 7 Tage
  • Offizieller Code, Datensätze und Checkpoints für „Timer: Generative Pre-trained Transformers Are Large Time Series Models“ (ICML 2024) und nachfolgende Arbeiten

    1.014+4Sterne-Änderung der letzten 7 Tage
  • aurora@microsoft

    Implementierung des Aurora-Modells für Erdsystemvorhersagen

    1.014+1Sterne-Änderung der letzten 7 Tage
  • groundingLMM@mbzuai-oryx

    [CVPR 2024 🔥] Grounding Large Multimodal Model (GLaMM), das weltweit erste Modell, das natürlichsprachliche Antworten generieren kann, die nahtlos in Objektdegmentierungsmasken integriert sind.

    967+0Sterne-Änderung der letzten 7 Tage
  • FasterViT@NVlabs

    Offizielle PyTorch-Implementierung von FasterViT: Fast Vision Transformers with Hierarchical Attention (ICLR 2024)

    925+0Sterne-Änderung der letzten 7 Tage
  • nucleotide-transformer@instadeepai

    Grundlagenmodelle für Genomik und Transkriptomik

    917+5Sterne-Änderung der letzten 7 Tage
  • vision_pilot@autowarefoundation

    Kostenloser und vollständig quelloffener L2-ADAS-Stack, angetrieben durch End-to-End-KI-Technologie

    884+15Sterne-Änderung der letzten 7 Tage
  • terratorch@torchgeo

    Ein Python-Toolkit zur Feinabstimmung von geospatialen Basismodellen (GFMs).

    857+5Sterne-Änderung der letzten 7 Tage
  • meerkat@HazyResearch

    Untersuchen und verstehen Sie Ihre Trainings- und Validierungsdaten.

    853+0Sterne-Änderung der letzten 7 Tage
  • VoxPoser@huangwl18

    VoxPoser: Kombinierbare 3D-Wertkarten für die Robotermanipulation mit Sprachmodellen

    834+1Sterne-Änderung der letzten 7 Tage
  • OpenCUA@xlang-ai

    [NeurIPS 2025 Spotlight] OpenCUA: Open Foundations für Computer-Use Agents

    833+4Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von 3D-Vision-Papern mit Bezug zur Robotik im Zeitalter großer Modelle wie LLMs/VLMs, inspiriert von awesome-computer-vision, einschließlich Papers, Codes und zugehörigen Websites

    822+3Sterne-Änderung der letzten 7 Tage
  • hyena-dna@HazyResearch

    Offizielle Implementierung von HyenaDNA, einem mit Hyena erstellten Genom-Basismodell für lange Sequenzen

    806-2Sterne-Änderung der letzten 7 Tage
  • ModelsGenesis@MrGiovanni

    [MICCAI 2019 Young Scientist Award] [MEDIA 2020 Best Paper Award] Models Genesis, eines der ersten "Fundament"-Modelle in der medizinischen Bildanalyse für verschiedene Downstream-Tasks

    791+1Sterne-Änderung der letzten 7 Tage
  • GigaAM@salute-developers

    Grundlegendes Modell für Spracherkennungsaufgaben

    789+20Sterne-Änderung der letzten 7 Tage
  • Modellzusammenführung in LLMs, MLLMs und darüber hinaus: Methoden, Theorien, Anwendungen und Möglichkeiten. ACM Computing Surveys, 2026.

    780+2Sterne-Änderung der letzten 7 Tage
  • mathcode@math-ai-org

    MathCode: Ein bahnbrechender Agent für mathematisches Programmieren.

    742+8Sterne-Änderung der letzten 7 Tage
  • tessera@ucam-eo

    [CVPR26] TESSERA ist ein Foundation Model, das Satellitenbilder im Zeitverlauf für Anwendungen wie Landklassifizierung und Kronenhöhenvorhersage verarbeiten kann. Es wurde an der University of Cambridge entwickelt und ermöglicht die effiziente Extraktion temporaler Muster aus Erdbeobachtungsdaten.

    732+14Sterne-Änderung der letzten 7 Tage
  • Uni3D@baaivision

    [ICLR'24 Spotlight] Uni3D: 3D-visuelle Repräsentation von BAAI

    685+1Sterne-Änderung der letzten 7 Tage
  • HoloMotion@HorizonRobotics

    HoloMotion: Ein Basismodell für die ganzheitliche Steuerung humanoider Roboter

    681+15Sterne-Änderung der letzten 7 Tage
  • RETFound@rmaphoh

    Vision-Grundlagenmodelle für medizinische KI, einschließlich RETFound, DINOv2 und DINOv3.

    671+3Sterne-Änderung der letzten 7 Tage
  • ✨✨ Neueste Papers und Benchmarks zum Reasoning mit Foundation Models

    657+1Sterne-Änderung der letzten 7 Tage
  • UniTS@mims-harvard

    Ein einheitliches Multitask-Modell für Zeitreihen.

    648+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen