WooooDyy/AgentGym-RL
@WooooDyyCode et implémentations pour l'article "AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning" par Zhiheng Xi et al.
Étoiles
863
Bifurcations
87
Langage
Python
Licence
MIT
Dernier push
il y a 7 mois
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.