reasoning
Repositórios de código aberto acompanhados marcados com reasoning, ordenados por estrelas.
- #31
Search-o1: Modelos de raciocínio amplo aprimorados por busca agentica [EMNLP 2025]
★ 1.245+2Variação de estrelas nos últimos 7 dias - #32
[WWW‘26 Oral🔥] DeepAgent: Um agente de raciocínio geral com conjuntos de ferramentas escaláveis
★ 1.137+3Variação de estrelas nos últimos 7 dias - #33
[NeurIPS 2025] TTRL: Aprendizado por Reforço em Tempo de Teste (Test-Time Reinforcement Learning).
★ 1.122+2Variação de estrelas nos últimos 7 dias - #34★ 1.090+13Variação de estrelas nos últimos 7 dias
- #35
Raciocínio multimodal de cadeia de pensamento: um levantamento abrangente
★ 1.025+2Variação de estrelas nos últimos 7 dias - #36
Um recurso central e aberto para dados e ferramentas relacionados ao raciocínio em cadeia de pensamento (chain-of-thought) em grandes modelos de linguagem. Desenvolvido pelo grupo de pesquisa Samwald: https://samwald.info/
★ 1.015+0Variação de estrelas nos últimos 7 dias - #37
[ACL 2023] Raciocínio com Prompting de Modelos de Linguagem: Um Levantamento
★ 1.007+1Variação de estrelas nos últimos 7 dias - #38
Código de pré-treinamento e inferência para um modelo de linguagem recorrente de profundidade em larga escala
★ 942+31Variação de estrelas nos últimos 7 dias - #39★ 928+4Variação de estrelas nos últimos 7 dias
- #40
[ACL 2026 KnowFM] Recursos incríveis para Pesquisa Profunda Agente (Awesome Agentic Deep Research Resources)
★ 861+6Variação de estrelas nos últimos 7 dias - #41
LLMs podem gerar feedback sobre seu próprio trabalho, usá-lo para melhorar o resultado e repetir esse processo iterativamente.
★ 820+0Variação de estrelas nos últimos 7 dias - #42★ 769+1Variação de estrelas nos últimos 7 dias
- #43★ 741+7Variação de estrelas nos últimos 7 dias
- #44★ 671+9Variação de estrelas nos últimos 7 dias
- #45
🌾 OAT: Uma estrutura amigável para pesquisa de alinhamento online de LLMs, incluindo aprendizado por reforço, aprendizado por preferência, etc.
★ 669-1Variação de estrelas nos últimos 7 dias - #46
✨✨ Últimos artigos e benchmarks em raciocínio com Modelos Fundacionais
★ 657+1Variação de estrelas nos últimos 7 dias - #47
Código em PyTorch para o artigo Energy-Based Transformers -- raciocínio generalizável e aprendizado escalável
★ 657+7Variação de estrelas nos últimos 7 dias - #48
Últimos avanços em raciocínio de cadeia de pensamento longa (Long Chain-of-Thought)
★ 647-1Variação de estrelas nos últimos 7 dias - #49
Código-base oficial para "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)
★ 642+2Variação de estrelas nos últimos 7 dias - #50
Explore o "Momento Aha" Multimodal em um modelo de 2B
★ 623+0Variação de estrelas nos últimos 7 dias - #51
código e documentação para o artigo do EMNLP "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning"
★ 562+0Variação de estrelas nos últimos 7 dias - #52★ 551-1Variação de estrelas nos últimos 7 dias
- #53
Implementação oficial do artigo do ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"
★ 532-1Variação de estrelas nos últimos 7 dias - #54★ 518+2Variação de estrelas nos últimos 7 dias
- #55
🔥🔥🔥[AAAI 2026 Oral] Official Implementation of Robust-R1: Degradation-Aware Reasoning for Robust Visual Understanding
★ 511+0Variação de estrelas nos últimos 7 dias - #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—Variação de estrelas nos últimos 7 dias