Pular para o conteúdo principal
buildradar
Sign in
Tópico · reasoning

reasoning

Repositórios de código aberto acompanhados marcados com reasoning, ordenados por estrelas.

56 repositórios
  • Search-o1@RUC-NLPIR

    Search-o1: Modelos de raciocínio amplo aprimorados por busca agentica [EMNLP 2025]

    1.245+2Variação de estrelas nos últimos 7 dias
  • DeepAgent@RUC-NLPIR

    [WWW‘26 Oral🔥] DeepAgent: Um agente de raciocínio geral com conjuntos de ferramentas escaláveis

    1.137+3Variação de estrelas nos últimos 7 dias
  • TTRL@PRIME-RL

    [NeurIPS 2025] TTRL: Aprendizado por Reforço em Tempo de Teste (Test-Time Reinforcement Learning).

    1.122+2Variação de estrelas nos últimos 7 dias
  • SDPO@lasgroup

    Aprendizado por reforço via autodestilação (SDPO)

    1.090+13Variação de estrelas nos últimos 7 dias
  • Awesome-MCoT@yaotingwangofficial

    Raciocínio multimodal de cadeia de pensamento: um levantamento abrangente

    1.025+2Variação de estrelas nos últimos 7 dias
  • ThoughtSource@OpenBioLink

    Um recurso central e aberto para dados e ferramentas relacionados ao raciocínio em cadeia de pensamento (chain-of-thought) em grandes modelos de linguagem. Desenvolvido pelo grupo de pesquisa Samwald: https://samwald.info/

    1.015+0Variação de estrelas nos últimos 7 dias
  • [ACL 2023] Raciocínio com Prompting de Modelos de Linguagem: Um Levantamento

    1.007+1Variação de estrelas nos últimos 7 dias
  • Código de pré-treinamento e inferência para um modelo de linguagem recorrente de profundidade em larga escala

    942+31Variação de estrelas nos últimos 7 dias
  • tutor-gpt@plastic-labs

    Tutor de IA alimentado por raciocínio de Teoria da Mente

    928+4Variação de estrelas nos últimos 7 dias
  • [ACL 2026 KnowFM] Recursos incríveis para Pesquisa Profunda Agente (Awesome Agentic Deep Research Resources)

    861+6Variação de estrelas nos últimos 7 dias
  • self-refine@madaan

    LLMs podem gerar feedback sobre seu próprio trabalho, usá-lo para melhorar o resultado e repetir esse processo iterativamente.

    820+0Variação de estrelas nos últimos 7 dias
  • Nucleoid@NucleoidAI

    Linguagem lógica para LLMs 🌱🐋 Construa modelos de mundo 🌍

    769+1Variação de estrelas nos últimos 7 dias
  • mathcode@math-ai-org

    MathCode: Um agente de codificação matemática de ponta

    741+7Variação de estrelas nos últimos 7 dias
  • golitex@litexlang

    Litex: A Linguagem Onde a Matemática se Verifica.

    671+9Variação de estrelas nos últimos 7 dias
  • oat@sail-sg

    🌾 OAT: Uma estrutura amigável para pesquisa de alinhamento online de LLMs, incluindo aprendizado por reforço, aprendizado por preferência, etc.

    669-1Variação de estrelas nos últimos 7 dias
  • ✨✨ Últimos artigos e benchmarks em raciocínio com Modelos Fundacionais

    657+1Variação de estrelas nos últimos 7 dias
  • EBT@alexiglad

    Código em PyTorch para o artigo Energy-Based Transformers -- raciocínio generalizável e aprendizado escalável

    657+7Variação de estrelas nos últimos 7 dias
  • Últimos avanços em raciocínio de cadeia de pensamento longa (Long Chain-of-Thought)

    647-1Variação de estrelas nos últimos 7 dias
  • RandOpt@sunrainyg

    Código-base oficial para "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)

    642+2Variação de estrelas nos últimos 7 dias
  • VisualThinker-R1-Zero@turningpoint-ai

    Explore o "Momento Aha" Multimodal em um modelo de 2B

    623+0Variação de estrelas nos últimos 7 dias
  • DeepPath@xwhan

    código e documentação para o artigo do EMNLP "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning"

    562+0Variação de estrelas nos últimos 7 dias
  • TCS-NQT@ArkS0001
    551-1Variação de estrelas nos últimos 7 dias
  • Implementação oficial do artigo do ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"

    532-1Variação de estrelas nos últimos 7 dias
  • QeRL@NVlabs

    [ICLR 2026] QeRL permite RL para LLMs de 32B em uma única GPU H100.

    518+2Variação de estrelas nos últimos 7 dias
  • Robust-R1@jqtangust

    🔥🔥🔥[AAAI 2026 Oral] Official Implementation of Robust-R1: Degradation-Aware Reasoning for Robust Visual Understanding

    511+0Variação de estrelas nos últimos 7 dias
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos