large-language-models
Repositorios de código abierto monitorizados etiquetados con large-language-models, ordenados por estrellas.
- #361
LLaVA-Mini es un modelo multimodal grande (LMM) unificado que admite la comprensión de imágenes, imágenes de alta resolución y videos de manera eficiente.
★ 577+0Variación de estrellas de los últimos 7 días - #362
[ICML 2025] "SepLLM: Acelera modelos de lenguaje grandes comprimiendo un segmento en un separador"
★ 572+0Variación de estrellas de los últimos 7 días - #363
Un sistema de clasificación flexible y adaptable para la clasificación dinámica de texto
★ 569+1Variación de estrellas de los últimos 7 días - #364
Una colección abierta de metodologías para ayudar en el entrenamiento exitoso de modelos de lenguaje grandes.
★ 569+2Variación de estrellas de los últimos 7 días - #365★ 568+0Variación de estrellas de los últimos 7 días
- #366★ 568+6Variación de estrellas de los últimos 7 días
- #367
¡Chatbot Arena se encuentra con la multimodalidad! Multi-Modality Arena te permite comparar modelos de visión-lenguaje lado a lado mientras proporcionas imágenes como entrada. ¡Soporta MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 y muchos más!
★ 566+0Variación de estrellas de los últimos 7 días - #368★ 564-1Variación de estrellas de los últimos 7 días
- #369
Versión en Java de LangChain, potenciando LLM para Big Data.
★ 564-1Variación de estrellas de los últimos 7 días - #370
Un prototipo de asistente para escribir y pensar
★ 562+0Variación de estrellas de los últimos 7 días - #371
Implementación oficial del artículo "DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models"
★ 559+0Variación de estrellas de los últimos 7 días - #372★ 559+0Variación de estrellas de los últimos 7 días
- #373
Pax es un framework de aprendizaje automático basado en Jax para entrenar modelos a gran escala. Pax permite una experimentación y paralelización avanzadas y totalmente configurables, y ha demostrado tasas de utilización de flops líderes en la industria.
★ 558+0Variación de estrellas de los últimos 7 días - #374
Repositorio para el artículo "Large Language Model-Based Agents for Software Engineering: A Survey". Actualización continua.
★ 556+1Variación de estrellas de los últimos 7 días - #375
[Hallazgos de EMNLP'25] Un sistema Graph RAG fácil de usar que utiliza conocimiento jerárquico.
★ 556+1Variación de estrellas de los últimos 7 días - #376★ 555+1Variación de estrellas de los últimos 7 días
- #377
🔥🔥🔥 Una lista seleccionada de artículos sobre generación multimodal basada en LLMs (imagen, video, 3D y audio).
★ 552+0Variación de estrellas de los últimos 7 días - #378
Meta Agents Research Environments es una plataforma integral diseñada para evaluar agentes de IA en escenarios dinámicos y realistas. A diferencia de los benchmarks estáticos, esta plataforma introduce entornos en evolución donde los agentes deben adaptar sus estrategias a medida que hay nueva información disponible, reflejando desafíos del mundo real.
★ 551+1Variación de estrellas de los últimos 7 días - #379
Pasarela universal de LLM: una API para todos los LLM. Endpoints compatibles con OpenAI/Anthropic con traducción entre múltiples proveedores y balanceo de carga inteligente.
★ 549+5Variación de estrellas de los últimos 7 días - #380
Una colección curada de recursos para ingeniería de IA aplicada (en desarrollo).
★ 549+2Variación de estrellas de los últimos 7 días - #381
Conjunto de datos y benchmark para RAG en documentos internos de empresas.
★ 548+8Variación de estrellas de los últimos 7 días - #382
Repositorio para el estudio de LLM4IR.
★ 545+0Variación de estrellas de los últimos 7 días - #383
[ICML'24 Spotlight] "TravelPlanner: un benchmark para la planificación en el mundo real con agentes de lenguaje"
★ 545+2Variación de estrellas de los últimos 7 días - #384
MiniMax M2.1, un modelo SOTA para desarrollo y agentes en el mundo real.
★ 543+0Variación de estrellas de los últimos 7 días - #385★ 539+2Variación de estrellas de los últimos 7 días
- #386
Una colección curada de artículos y recursos sobre destilación on-policy para modelos de lenguaje grandes.
★ 537+10Variación de estrellas de los últimos 7 días - #387★ 534+0Variación de estrellas de los últimos 7 días
- #388
[NeurIPS'23] H2O: Heavy-Hitter Oracle para la inferencia generativa eficiente de modelos de lenguaje de gran tamaño.
★ 533+1Variación de estrellas de los últimos 7 días - #389
Implementación oficial del artículo de ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"
★ 532+0Variación de estrellas de los últimos 7 días - #390
[NeurIPS 2025 Spotlight] Un tokenizador unificado para la generación y comprensión visual.
★ 529-1Variación de estrellas de los últimos 7 días