跳到主要內容
buildradar
登入

PKU-Alignment/safe-rlhf

@PKU-Alignment

Safe RLHF:透過來自人類回饋的安全強化學習進行受約束的價值對齊

星數
1,613
Fork 數
134
語言
Python
授權
Apache-2.0
最後推送
10 個月前
Pythonllmgptlarge-language-modelstransformerllmsreinforcement-learningdeepspeedtransformersai-safetyllamadatasetsrlhfvicunasafetysafe-reinforcement-learningalpacareinforcement-learning-from-human-feedbackbeaversafe-reinforcement-learning-from-human-feedbacksafe-rlhf

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。