メインコンテンツへスキップ
buildradar
ログイン

lucidrains/PaLM-rlhf-pytorch

@lucidrains

PaLMアーキテクチャ上に実装されたRLHF (Reinforcement Learning with Human Feedback)。基本的にChatGPTだがPaLMを使用している。

スター
7,864
フォーク
673
言語
Python
ライセンス
MIT
最終プッシュ
2 か月前
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。