lucidrains/PaLM-rlhf-pytorch
@lucidrains在 PaLM 架构之上实现 RLHF(带人类反馈的强化学习)。基本上是 ChatGPT,但使用 PaLM。
星数
7,866
Fork 数
673
语言
Python
许可
MIT
最后推送
2个月前
相关情报(0)
还没有相关情报
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。
在 PaLM 架构之上实现 RLHF(带人类反馈的强化学习)。基本上是 ChatGPT,但使用 PaLM。
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。