Chuyển tới nội dung chính
buildradar
Đăng nhập

TianhongDai/reinforcement-learning-algorithms

@TianhongDai

Kho lưu trữ này chứa hầu hết các triển khai PyTorch dựa trên các thuật toán học tăng cường sâu cổ điển, bao gồm - DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO. (Các thuật toán khác vẫn đang được phát triển)

Sao
697
Fork
110
Ngôn ngữ
Python
Giấy phép
Push gần nhất
9 tháng trước
Pythondeep-learningdeep-reinforcement-learningpytorchalgorithmppoproximal-policy-optimizationsacsoft-actor-critica2cddpgdqnactor-criticatari2600dueling-dqnflappy-birdtrpotrust-region-policy-optimization

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.