WooooDyy/AgentGym-RL
@WooooDyyZhiheng Xi らによる論文「AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning」のコードと実装。
スター
863
フォーク
87
言語
Python
ライセンス
MIT
最終プッシュ
7 か月前
関連 Intel(0)
関連 Intel はまだありません
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。