跳到主要内容
buildradar
登录

tatsu-lab/alpaca_farm

@tatsu-lab

用于 RLHF 及其替代方案的模拟框架。无需收集人类数据即可开发您的 RLHF 方法。

星数
844
Fork 数
66
语言
Python
许可
Apache-2.0
最后推送
2年前
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。