मुख्य सामग्री पर जाएँ
buildradar
Sign in

mll-lab-nu/RAGEN

@mll-lab-nu

LLM एजेंटों के लिए एजेंट RL फ्रेमवर्क: StarPO और रीजनिंग-कोलैप्स डायग्नोस्टिक्स के साथ मल्टी-टर्न सुदृढीकरण शिक्षण (reinforcement learning)

स्टार
2,786
फ़ोर्क
227
भाषा
Python
लाइसेंस
MIT
आख़िरी push
2 सप्ताह पहले
Pythonllm-agentsagentic-aireinforcement-learningagent-rlmulti-turn-rlrl-framework

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।