본문으로 건너뛰기
buildradar
Sign in

langfengQ/verl-agent

@langfengQ

verl-agent는 RL을 통한 LLM/VLM 에이전트 학습을 위해 설계된 veRL의 확장입니다. 또한 'Group-in-Group Policy Optimization for LLM Agent Training' 논문의 공식 코드입니다.

스타
2,274
포크
219
언어
Python
라이선스
Apache-2.0
마지막 푸시
3개월 전
Pythonagent-frameworkllm-agentslarge-language-modelsreinforcement-learningdeepseek-r1grpollm-traininggigpo

아직 관련 인텔이 없습니다

이 저장소는 radar가 추적하는 어떤 소스에도 아직 등장하지 않았습니다. 수집기는 예약에 따라 실행됩니다——이 저장소를 다루게 되면 다시 확인하세요.