跳到主要內容
buildradar
登入

lucidrains/PaLM-rlhf-pytorch

@lucidrains

在 PaLM 架構之上實作 RLHF(帶人類回饋的強化學習)。基本上是 ChatGPT,但使用 PaLM。

星數
7,866
Fork 數
673
語言
Python
授權
MIT
最後推送
2 個月前
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。