跳到主要内容
buildradar
登录

lucidrains/self-rewarding-lm-pytorch

@lucidrains

MetaAI 所提出的 Self-Rewarding Language Model 训练框架的实现

星数
1,411
Fork 数
70
语言
Python
许可
MIT
最后推送
2年前
Pythondeep-learningartificial-intelligencetransformersbeyond-human-dataself-rewarding

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。