跳到主要內容
buildradar
登入

WooooDyy/AgentGym-RL

@WooooDyy

論文「AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning」的程式碼與實作,作者為 Zhiheng Xi 等人。

星數
863
Fork 數
87
語言
Python
授權
MIT
最後推送
7 個月前
Pythonagentllmscalingllm-based-agent

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。