Chuyển tới nội dung chính
buildradar
Đăng nhập

vwxyzjn/cleanrl

@vwxyzjn

Triển khai tệp đơn chất lượng cao cho các thuật toán Deep Reinforcement Learning với các tính năng thân thiện với nghiên cứu (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

Sao
10.358
Fork
1.160
Ngôn ngữ
Python
Giấy phép
NOASSERTION
Push gần nhất
5 tháng trước
Pythonpythonmachine-learningdeep-learninggymdeep-reinforcement-learningpytorchreinforcement-learningatarippoproximal-policy-optimizationa2cadvantage-actor-criticwandbactor-criticalephasic-policy-gradient

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.