reasoning
Repositorios de código abierto monitorizados etiquetados con reasoning, ordenados por estrellas.
- #31
Search-o1: Modelos de razonamiento grande con búsqueda mejorada mediante agentes [EMNLP 2025]
★ 1245+2Variación de estrellas de los últimos 7 días - #32
[WWW‘26 Oral🔥] DeepAgent: Un agente de razonamiento general con conjuntos de herramientas escalables
★ 1137+3Variación de estrellas de los últimos 7 días - #33★ 1122+1Variación de estrellas de los últimos 7 días
- #34★ 1090+11Variación de estrellas de los últimos 7 días
- #35
Razonamiento multimodal de cadena de pensamiento: un estudio exhaustivo
★ 1025+2Variación de estrellas de los últimos 7 días - #36
Un recurso central y abierto para datos y herramientas relacionados con el razonamiento de cadena de pensamientos en modelos de lenguaje grandes. Desarrollado en el grupo de investigación de Samwald: https://samwald.info/
★ 1015+0Variación de estrellas de los últimos 7 días - #37
[ACL 2023] Razonamiento con prompting de modelos de lenguaje: un estudio.
★ 1007+1Variación de estrellas de los últimos 7 días - #38
Código de preentrenamiento e inferencia para un modelo de lenguaje recurrente de profundidad a gran escala
★ 942+22Variación de estrellas de los últimos 7 días - #39★ 928+4Variación de estrellas de los últimos 7 días
- #40
[ACL 2026 KnowFM] Recursos increíbles sobre investigación profunda con agentes
★ 861+6Variación de estrellas de los últimos 7 días - #41
Los LLM pueden generar comentarios sobre su propio trabajo, utilizarlos para mejorar el resultado y repetir este proceso de forma iterativa.
★ 820+0Variación de estrellas de los últimos 7 días - #42★ 769+1Variación de estrellas de los últimos 7 días
- #43★ 741+6Variación de estrellas de los últimos 7 días
- #44★ 671+10Variación de estrellas de los últimos 7 días
- #45
🌾 OAT: Un marco de trabajo amigable para la investigación de alineación en línea de LLM, que incluye aprendizaje por refuerzo, aprendizaje de preferencias, etc.
★ 669-1Variación de estrellas de los últimos 7 días - #46
Código de PyTorch para el artículo Energy-Based Transformers: razonamiento generalizable y aprendizaje escalable
★ 657+5Variación de estrellas de los últimos 7 días - #47
✨✨Últimos artículos y benchmarks sobre razonamiento con modelos base
★ 657+0Variación de estrellas de los últimos 7 días - #48
Últimos avances en razonamiento de cadena de pensamiento larga (Long Chain-of-Thought)
★ 647-1Variación de estrellas de los últimos 7 días - #49
Repositorio oficial para "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)
★ 642+2Variación de estrellas de los últimos 7 días - #50
Explora el momento "Aha" multimodal en un modelo de 2B.
★ 623+0Variación de estrellas de los últimos 7 días - #51
Código y documentación para el artículo de EMNLP "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning".
★ 562+0Variación de estrellas de los últimos 7 días - #52★ 552-1Variación de estrellas de los últimos 7 días
- #53
Implementación oficial del artículo de ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"
★ 532-1Variación de estrellas de los últimos 7 días - #54★ 518+2Variación de estrellas de los últimos 7 días
- #55
🔥🔥🔥 [AAAI 2026 Oral] Implementación oficial de Robust-R1: Razonamiento consciente de la degradación para una comprensión visual robusta
★ 511+0Variación de estrellas de los últimos 7 días - #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—Variación de estrellas de los últimos 7 días