WooooDyy/AgentGym-RL
@WooooDyyZhiheng Xi और अन्य द्वारा लिखित शोध पत्र "AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning" के लिए कोड और कार्यान्वयन।
स्टार
863
फ़ोर्क
87
भाषा
Python
लाइसेंस
MIT
आख़िरी push
7 माह पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।