reinforcement-learning-algorithms
Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning-algorithms, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng reinforcement-learning-algorithms trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ reinforcement-learning-algorithms.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Phiên bản PyTorch của Stable Baselines, các bản cài đặt đáng tin cậy của thuật toán học tăng cường.
★ 13.758+21Thay đổi số sao trong 7 ngày qua - #2
Kho lưu trữ cho chương trình Deep Reinforcement Learning Nanodegree
★ 5.176+0Thay đổi số sao trong 7 ngày qua - #3
OpenDILab Decision AI Engine. Framework Reinforcement Learning toàn diện nhất B.P.
★ 3.642+1Thay đổi số sao trong 7 ngày qua - #4
Bản cài đặt tối giản của thuật toán Proximal Policy Optimization (PPO) với hàm mục tiêu bị cắt xén trong PyTorch
★ 2.381+6Thay đổi số sao trong 7 ngày qua - #5
Danh sách tổng hợp các tài nguyên học tăng cường dựa trên mô hình tuyệt vời (được cập nhật liên tục)
★ 1.393+0Thay đổi số sao trong 7 ngày qua - #6
Một bản cài đặt PPO đơn giản và có phong cách. Dựa trên chuỗi bài viết trên Medium của tôi: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.
★ 1.269+1Thay đổi số sao trong 7 ngày qua - #7★ 1.116+5Thay đổi số sao trong 7 ngày qua
- #8★ 1.102+2Thay đổi số sao trong 7 ngày qua
- #9
UI-Venus là một tác nhân UI nguyên bản được thiết kế để thực hiện định vị phần tử GUI chính xác và điều hướng hiệu quả chỉ bằng đầu vào là ảnh chụp màn hình.
★ 1.037+23Thay đổi số sao trong 7 ngày qua - #10
Danh sách tài nguyên Decision Transformer được tuyển chọn (cập nhật liên tục)
★ 916+0Thay đổi số sao trong 7 ngày qua - #11
Khóa học deep learning NMA
★ 812+1Thay đổi số sao trong 7 ngày qua - #12
MDP và POMDP trong Julia - Giao diện để định nghĩa, giải quyết và mô phỏng các quá trình quyết định Markov quan sát được toàn phần và một phần trên không gian rời rạc và liên tục.
★ 766+1Thay đổi số sao trong 7 ngày qua - #13
Gói đóng góp cho Stable-Baselines3 - Mã học tăng cường (RL) thử nghiệm
★ 736+5Thay đổi số sao trong 7 ngày qua - #14
Đây là dự án về thuật toán tránh chướng ngại vật tự động dựa trên học tăng cường sâu cho UAV.
★ 730+0Thay đổi số sao trong 7 ngày qua - #15
Mã nguồn đi kèm cho ấn phẩm Nature "Discovering State-of-the-art Reinforcement Algorithms".
★ 728+2Thay đổi số sao trong 7 ngày qua - #16
Danh sách các tài nguyên học tập về Reinforcement Learning (RL) chất lượng (được cập nhật liên tục)
★ 723+0Thay đổi số sao trong 7 ngày qua - #17
Mã nguồn cho bài báo "Tối ưu hóa giảm tải tính toán cho điện toán biên di động hỗ trợ UAV: Phương pháp Deep Deterministic Policy Gradient".
★ 722+1Thay đổi số sao trong 7 ngày qua - #18★ 720+1Thay đổi số sao trong 7 ngày qua
- #19
Danh sách các bài báo nghiên cứu về tìm kiếm cây Monte Carlo kèm theo các bản triển khai
★ 715+1Thay đổi số sao trong 7 ngày qua - #20
Thư viện PyTorch để xây dựng các tác nhân học tăng cường sâu
★ 657+0Thay đổi số sao trong 7 ngày qua - #21
[ICLR 2026] Mã nguồn chính thức cho TraceRL: Cách mạng hóa quá trình hậu huấn luyện cho Diffusion LLM, hỗ trợ dòng TraDo SOTA.
★ 520+1Thay đổi số sao trong 7 ngày qua