OpenLMLab의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
대규모 언어 모델(LLM)의 RLHF 비밀 파트 I: PPO
LOMO: 저메모리 최적화(LOw-Memory Optimization)
GAOKAO-Bench는 대규모 언어 모델을 평가하기 위해 가오카오(GAOKAO) 문제를 데이터셋으로 활용하는 평가 프레임워크입니다.