मुख्य सामग्री पर जाएँ
buildradar
Sign in

OpenPipe/ART

@OpenPipe

Agent Reinforcement Trainer: GRPO का उपयोग करके वास्तविक दुनिया के कार्यों के लिए मल्टी-स्टेप एजेंटों को प्रशिक्षित करें। अपने एजेंटों को ऑन-द-जॉब ट्रेनिंग दें। Qwen3.6, GPT-OSS, Llama और अन्य के लिए रीइन्फोर्समेंट लर्निंग।

स्टार
10,689
फ़ोर्क
980
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
4 दिन पहले
Pythonagentrlloraagentic-aillmsreinforcement-learningqwenqwen3grpo

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।