Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · proximal-policy-optimization

proximal-policy-optimization

Các kho mã nguồn mở đang theo dõi được gắn thẻ proximal-policy-optimization, sắp xếp theo số sao.

Kho mã
7
Tổng số sao
34.133
Số sao trung bình
4.876
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng proximal-policy-optimization trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ proximal-policy-optimization.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • cleanrl@vwxyzjn

    Triển khai tệp đơn chất lượng cao cho các thuật toán Deep Reinforcement Learning với các tính năng thân thiện với nghiên cứu (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

    10.358+32Thay đổi số sao trong 7 ngày qua
  • OpenRLHF@OpenRLHF

    Một khung làm việc Agentic RL dễ sử dụng, có khả năng mở rộng và hiệu năng cao dựa trên Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9.969+13Thay đổi số sao trong 7 ngày qua
  • Hướng dẫn học tăng cường đơn giản, tài liệu giảng dạy AI tiếng Trung của MoFan Python

    9.508+2Thay đổi số sao trong 7 ngày qua
  • PPO-PyTorch@nikhilbarhate99

    Bản cài đặt tối giản của thuật toán Proximal Policy Optimization (PPO) với hàm mục tiêu bị cắt xén trong PyTorch

    2.381+6Thay đổi số sao trong 7 ngày qua
  • Kho lưu trữ này chứa hầu hết các triển khai PyTorch dựa trên các thuật toán học tăng cường sâu cổ điển, bao gồm - DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO. (Các thuật toán khác vẫn đang được phát triển)

    697+0Thay đổi số sao trong 7 ngày qua
  • Thư viện PyTorch để xây dựng các tác nhân học tăng cường sâu

    657+1Thay đổi số sao trong 7 ngày qua
  • Học tăng cường sâu (PPO) trong lái xe tự động (Carla) [từ đầu]

    563+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề