Pular para o conteúdo principal
buildradar
Sign in

mll-lab-nu/RAGEN

@mll-lab-nu

O RAGEN utiliza aprendizado por reforço para treinar agentes de raciocínio LLM em ambientes interativos e estocásticos.

Estrelas
2.786
Bifurcações
227
Linguagem
Python
Licença
MIT
Último push
há 2 semanas
Pythonllm-agentsagentic-aireinforcement-learningagent-rlmulti-turn-rlrl-framework

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.