foundation-models
Repositorios de código abierto monitorizados etiquetados con foundation-models, ordenados por estrellas.
- #31
Catálogo visual curado de más de 155 arquitecturas de modelos de visión-lenguaje (VLM/MLLM): artículos, diagramas, recetas de entrenamiento, conjuntos de datos y una línea de tiempo de lanzamiento para agentes de IA multimodal.
★ 1310+2Variación de estrellas de los últimos 7 días - #32
Artículos de lectura obligatoria sobre edición de conocimientos para Modelos de Lenguaje Grandes (LLM).
★ 1246-1Variación de estrellas de los últimos 7 días - #33
Una lista profesional sobre modelos de lenguaje grandes (LLM) y modelos fundacionales (LM, FM) para series temporales, datos espaciotemporales y datos de eventos.
★ 1222+0Variación de estrellas de los últimos 7 días - #34
TorchXRayVision: una biblioteca de conjuntos de datos y modelos de radiografías de tórax. Incluye clasificadores, segmentación y autoencoders.
★ 1188+3Variación de estrellas de los últimos 7 días - #35
Laboratorio práctico para construir, probar y evaluar aplicaciones con el framework de modelos fundacionales de Apple.
★ 1178+1Variación de estrellas de los últimos 7 días - #36
Una lista curada de modelos base para tareas de visión y lenguaje.
★ 1177+0Variación de estrellas de los últimos 7 días - #37
Un modelo de representación general para modalidades de visión, audio y lenguaje. Artículo: ONE-PEACE: Explorando un modelo de representación general hacia modalidades ilimitadas.
★ 1060+0Variación de estrellas de los últimos 7 días - #38
[Candidato a mejor artículo en ECCV 2024 y TPAMI 2025] PointLLM: Potenciando a los modelos de lenguaje extenso para comprender nubes de puntos.
★ 1054+2Variación de estrellas de los últimos 7 días - #39★ 1014+1Variación de estrellas de los últimos 7 días
- #40
Código oficial, conjuntos de datos y puntos de control para "Timer: Generative Pre-trained Transformers Are Large Time Series Models" (ICML 2024) y trabajos posteriores
★ 1014+3Variación de estrellas de los últimos 7 días - #41
[CVPR 2024 🔥] Grounding Large Multimodal Model (GLaMM), el primer modelo de su clase capaz de generar respuestas en lenguaje natural integradas perfectamente con máscaras de segmentación de objetos.
★ 967+0Variación de estrellas de los últimos 7 días - #42
[ICLR 2024] Implementación oficial en PyTorch de FasterViT: Vision Transformers rápidos con atención jerárquica.
★ 925+0Variación de estrellas de los últimos 7 días - #43
Modelos fundamentales para genómica y transcriptómica.
★ 917+5Variación de estrellas de los últimos 7 días - #44
Stack de ADAS de nivel 2 gratuito y de código abierto impulsado por tecnología de IA de extremo a extremo
★ 884+13Variación de estrellas de los últimos 7 días - #45
Un kit de herramientas en Python para el ajuste fino de modelos geoespaciales fundamentales (GFM).
★ 857+5Variación de estrellas de los últimos 7 días - #46★ 853+0Variación de estrellas de los últimos 7 días
- #47
VoxPoser: Mapas de valores 3D componibles para manipulación robótica con modelos de lenguaje.
★ 834+1Variación de estrellas de los últimos 7 días - #48
[NeurIPS 2025 Spotlight] OpenCUA: Fundamentos abiertos para agentes de uso informático
★ 833+4Variación de estrellas de los últimos 7 días - #49
Una lista curada de artículos de visión 3D relacionados con el dominio de la robótica en la era de los grandes modelos, es decir, LLMs/VLMs, inspirada en awesome-computer-vision, que incluye artículos, códigos y sitios web relacionados
★ 822+2Variación de estrellas de los últimos 7 días - #50
Implementación oficial de HyenaDNA, un modelo fundacional genómico de largo alcance construido con Hyena
★ 806-2Variación de estrellas de los últimos 7 días - #51
[Premio al Joven Científico MICCAI 2019] [Premio al Mejor Artículo MEDIA 2020] Models Genesis, uno de los primeros modelos "fundacionales" en el análisis de imágenes médicas para múltiples tareas posteriores
★ 791+1Variación de estrellas de los últimos 7 días - #52★ 789+17Variación de estrellas de los últimos 7 días
- #53
Fusión de modelos en LLMs, MLLMs y más allá: métodos, teorías, aplicaciones y oportunidades. ACM Computing Surveys, 2026.
★ 780+1Variación de estrellas de los últimos 7 días - #54★ 742+7Variación de estrellas de los últimos 7 días
- #55
[CVPR26] TESSERA es un modelo base capaz de procesar imágenes satelitales de series temporales para aplicaciones como la clasificación de terrenos y la predicción de la altura del dosel. Desarrollado en la Universidad de Cambridge, permite la extracción eficiente de patrones temporales a partir de la observación de la Tierra.
★ 732+14Variación de estrellas de los últimos 7 días - #56★ 685+1Variación de estrellas de los últimos 7 días
- #57
HoloMotion: Un modelo fundacional para el control humanoide de cuerpo completo
★ 681+15Variación de estrellas de los últimos 7 días - #58★ 671+3Variación de estrellas de los últimos 7 días
- #59
✨✨Últimos artículos y benchmarks sobre razonamiento con modelos base
★ 657+1Variación de estrellas de los últimos 7 días - #60★ 648+1Variación de estrellas de los últimos 7 días