跳到主要内容
buildradar
登录

opendilab/awesome-RLHF

@opendilab

一份经过精选的强化学习与人类反馈资源列表(持续更新)

星数
4,424
Fork 数
260
语言
许可
Apache-2.0
最后推送
4个月前
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。