OpenLMLab 收錄中的開源專案,依星數排序。
大型語言模型中 RLHF 的祕密第一部:PPO
LOMO:低記憶體最佳化
GAOKAO-Bench 是一個利用高考題目作為資料集來評估大型語言模型的評估框架。