跳到主要内容
buildradar
登录

langfengQ/verl-agent

@langfengQ

verl-agent 是 veRL 的扩展,专为通过强化学习 (RL) 训练 LLM/VLM Agent 所设计。verl-agent 也是论文 "Group-in-Group Policy Optimization for LLM Agent Training" 的官方代码。

星数
2,274
Fork 数
219
语言
Python
许可
Apache-2.0
最后推送
3个月前
Pythonagent-frameworkllm-agentslarge-language-modelsreinforcement-learningdeepseek-r1grpollm-traininggigpo

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。