Chuyển tới nội dung chính
buildradar
Sign in

WooooDyy/AgentGym-RL

@WooooDyy

Mã nguồn và triển khai cho bài báo "AgentGym-RL: Huấn luyện tác nhân LLM để ra quyết định dài hạn thông qua học tăng cường đa lượt" của Zhiheng Xi và cộng sự.

Sao
863
Fork
87
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
7 tháng trước
Pythonagentllmscalingllm-based-agent

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.