Saltar al contenido principal
buildradar
Sign in

mll-lab-nu/RAGEN

@mll-lab-nu

RAGEN aprovecha el aprendizaje por refuerzo para entrenar agentes de razonamiento de LLM en entornos interactivos y estocásticos.

Estrellas
2786
Bifurcaciones
227
Lenguaje
Python
Licencia
MIT
Último push
hace 2 semanas
Pythonllm-agentsagentic-aireinforcement-learningagent-rlmulti-turn-rlrl-framework

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.