跳到主要内容
buildradar
登录

WooooDyy/AgentGym-RL

@WooooDyy

论文“AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning”的代码与实现,作者为 Zhiheng Xi 等人。

星数
864
Fork 数
87
语言
Python
许可
MIT
最后推送
7个月前
Pythonagentllmscalingllm-based-agent

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。