natolambert/rlhf-book
@natolambert人类反馈强化学习(RLHF)教科书
星数
2,357
Fork 数
258
语言
Python
许可
NOASSERTION
最后推送
1周前
相关情报(0)
还没有相关情报
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。
人类反馈强化学习(RLHF)教科书
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。