跳到主要內容
buildradar
登入

opendilab/awesome-RLHF

@opendilab

一份經過精選的強化學習與人類反饋資源列表(持續更新)

星數
4,424
Fork 數
260
語言
授權
Apache-2.0
最後推送
4 個月前
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。