メインコンテンツへスキップ
buildradar
ログイン

lucidrains/self-rewarding-lm-pytorch

@lucidrains

MetaAI による Self-Rewarding Language Model で提案されたトレーニングフレームワークの実装

スター
1,410
フォーク
70
言語
Python
ライセンス
MIT
最終プッシュ
2 年前
Pythondeep-learningartificial-intelligencetransformersbeyond-human-dataself-rewarding

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。