proximal-policy-optimization
Các kho mã nguồn mở đang theo dõi được gắn thẻ proximal-policy-optimization, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng proximal-policy-optimization trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ proximal-policy-optimization.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Triển khai tệp đơn chất lượng cao cho các thuật toán Deep Reinforcement Learning với các tính năng thân thiện với nghiên cứu (PPO, DQN, C51, DDPG, TD3, SAC, PPG)
★ 10.358+32Thay đổi số sao trong 7 ngày qua - #2
Một khung làm việc Agentic RL dễ sử dụng, có khả năng mở rộng và hiệu năng cao dựa trên Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
★ 9.969+13Thay đổi số sao trong 7 ngày qua - #3
Hướng dẫn học tăng cường đơn giản, tài liệu giảng dạy AI tiếng Trung của MoFan Python
★ 9.508+2Thay đổi số sao trong 7 ngày qua - #4
Bản cài đặt tối giản của thuật toán Proximal Policy Optimization (PPO) với hàm mục tiêu bị cắt xén trong PyTorch
★ 2.381+6Thay đổi số sao trong 7 ngày qua - #5
Kho lưu trữ này chứa hầu hết các triển khai PyTorch dựa trên các thuật toán học tăng cường sâu cổ điển, bao gồm - DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO. (Các thuật toán khác vẫn đang được phát triển)
★ 697+0Thay đổi số sao trong 7 ngày qua - #6
Thư viện PyTorch để xây dựng các tác nhân học tăng cường sâu
★ 657+1Thay đổi số sao trong 7 ngày qua - #7
Học tăng cường sâu (PPO) trong lái xe tự động (Carla) [từ đầu]
★ 563+0Thay đổi số sao trong 7 ngày qua