跳到主要內容
buildradar
Sign in

OpenPipe/ART

@OpenPipe

Agent Reinforcement Trainer:使用 GRPO 訓練多步驟代理以執行真實任務。為您的代理提供在職訓練。支援 Qwen3.6、GPT-OSS、Llama 等的強化學習

星數
10,689
Fork 數
980
語言
Python
授權
Apache-2.0
最後推送
5 天前
Pythonagentrlloraagentic-aillmsreinforcement-learningqwenqwen3grpo

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。