OpenLMLab の追跡中のオープンソースリポジトリを、スター数順に表示します。
大規模言語モデルにおける RLHF の秘密 パート1: PPO
LOMO: 低メモリ最適化(LOw-Memory Optimization)
GAOKAO-Benchは、大規模言語モデルを評価するためのデータセットとして高考(GAOKAO)の問題を利用する評価フレームワークです。