メインコンテンツへスキップ
buildradar
Sign in

WooooDyy/AgentGym-RL

@WooooDyy

Zhiheng Xi らによる論文「AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning」のコードと実装。

スター
863
フォーク
87
言語
Python
ライセンス
MIT
最終プッシュ
7 か月前
Pythonagentllmscalingllm-based-agent

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。