跳到主要內容
buildradar
登入

tatsu-lab/alpaca_farm

@tatsu-lab

用於 RLHF 及其替代方案的模擬框架。無需收集人類數據即可開發您的 RLHF 方法。

星數
844
Fork 數
66
語言
Python
授權
Apache-2.0
最後推送
2 年前
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。