Pular para o conteúdo principal
buildradar
Entrar

open-thought/reasoning-gym

@open-thought

[NeurIPS 2025 Spotlight] Ambientes de raciocínio para aprendizado por reforço com recompensas verificáveis

Estrelas
1.500
Bifurcações
129
Linguagem
Python
Licença
Apache-2.0
Último push
há 5 meses
Pythonlarge-language-modelsgymreinforcement-learning

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.