WooooDyy/AgentGym-RL
@WooooDyyMã nguồn và triển khai cho bài báo "AgentGym-RL: Huấn luyện tác nhân LLM để ra quyết định dài hạn thông qua học tăng cường đa lượt" của Zhiheng Xi và cộng sự.
Sao
863
Fork
87
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
7 tháng trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.