跳到主要内容
buildradar
Sign in

OpenPipe/ART

@OpenPipe

Agent Reinforcement Trainer:使用 GRPO 训练多步骤代理以执行真实任务。为您的代理提供在职培训。支持 Qwen3.6、GPT-OSS、Llama 等的强化学习

星数
10,689
Fork 数
980
语言
Python
许可
Apache-2.0
最后推送
5天前
Pythonagentrlloraagentic-aillmsreinforcement-learningqwenqwen3grpo

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。