lucidrains/self-rewarding-lm-pytorch
@lucidrainsMetaAI による Self-Rewarding Language Model で提案されたトレーニングフレームワークの実装
スター
1,410
フォーク
70
言語
Python
ライセンス
MIT
最終プッシュ
2 年前
関連 Intel(0)
関連 Intel はまだありません
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。