跳到主要内容
buildradar
登录

mll-lab-nu/RAGEN

@mll-lab-nu

RAGEN 利用强化学习在交互式随机环境中训练 LLM 推理 Agent。

星数
2,786
Fork 数
227
语言
Python
许可
MIT
最后推送
3周前
Pythonllm-agentsagentic-aireinforcement-learningagent-rlmulti-turn-rlrl-framework

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。