Chuyển tới nội dung chính
buildradar
Sign in

langfengQ/verl-agent

@langfengQ

verl-agent là một phần mở rộng của veRL, được thiết kế để huấn luyện các LLM/VLM agent thông qua RL. verl-agent cũng là mã nguồn chính thức cho bài báo "Group-in-Group Policy Optimization for LLM Agent Training"

Sao
2.274
Fork
219
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
3 tháng trước
Pythonagent-frameworkllm-agentslarge-language-modelsreinforcement-learningdeepseek-r1grpollm-traininggigpo

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.