WooooDyy/AgentGym-RL
@WooooDyyCódigo e implementaciones para el artículo "AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning" de Zhiheng Xi et al.
Estrellas
863
Bifurcaciones
87
Lenguaje
Python
Licencia
MIT
Último push
hace 7 meses
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.