mll-lab-nu/RAGEN
@mll-lab-nuLLM एजेंटों के लिए एजेंट RL फ्रेमवर्क: StarPO और रीजनिंग-कोलैप्स डायग्नोस्टिक्स के साथ मल्टी-टर्न सुदृढीकरण शिक्षण (reinforcement learning)
स्टार
2,786
फ़ोर्क
227
भाषा
Python
लाइसेंस
MIT
आख़िरी push
2 सप्ताह पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।