WooooDyy/AgentGym-RL
@WooooDyyCode und Implementierungen zum Paper „AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning“ von Zhiheng Xi et al.
Sterne
863
Forks
87
Sprache
Python
Lizenz
MIT
Letzter Push
vor 7 Monaten
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.