소유자 · langfengQ
langfengQ
langfengQ의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
리포지토리 1개
- #1
verl-agent는 RL을 통한 LLM/VLM 에이전트 학습을 위해 설계된 veRL의 확장입니다. 또한 'Group-in-Group Policy Optimization for LLM Agent Training' 논문의 공식 코드입니다.
★ 2,274+17최근 7일 스타 변화
langfengQ의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
verl-agent는 RL을 통한 LLM/VLM 에이전트 학습을 위해 설계된 veRL의 확장입니다. 또한 'Group-in-Group Policy Optimization for LLM Agent Training' 논문의 공식 코드입니다.