Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · reinforcement-learning-algorithms

reinforcement-learning-algorithms

Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning-algorithms, sắp xếp theo số sao.

Kho mã
21
Tổng số sao
39.604
Số sao trung bình
1.886
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng reinforcement-learning-algorithms trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ reinforcement-learning-algorithms.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • Phiên bản PyTorch của Stable Baselines, các bản cài đặt đáng tin cậy của thuật toán học tăng cường.

    13.758+21Thay đổi số sao trong 7 ngày qua
  • deep-reinforcement-learning@udacity

    Kho lưu trữ cho chương trình Deep Reinforcement Learning Nanodegree

    5.176+0Thay đổi số sao trong 7 ngày qua
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. Framework Reinforcement Learning toàn diện nhất B.P.

    3.642+1Thay đổi số sao trong 7 ngày qua
  • PPO-PyTorch@nikhilbarhate99

    Bản cài đặt tối giản của thuật toán Proximal Policy Optimization (PPO) với hàm mục tiêu bị cắt xén trong PyTorch

    2.381+6Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các tài nguyên học tăng cường dựa trên mô hình tuyệt vời (được cập nhật liên tục)

    1.393+0Thay đổi số sao trong 7 ngày qua
  • PPO-for-Beginners@ericyangyu

    Một bản cài đặt PPO đơn giản và có phong cách. Dựa trên chuỗi bài viết trên Medium của tôi: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1.269+1Thay đổi số sao trong 7 ngày qua
  • ARPO@RUC-NLPIR

    [ICLR 2026] Tối ưu hóa chính sách tăng cường dựa trên tác nhân (ARPO)

    1.116+5Thay đổi số sao trong 7 ngày qua
  • purejaxrl@luchris429

    Các cài đặt Jax RL đầu cuối cực nhanh

    1.102+2Thay đổi số sao trong 7 ngày qua
  • UI-Venus@inclusionAI

    UI-Venus là một tác nhân UI nguyên bản được thiết kế để thực hiện định vị phần tử GUI chính xác và điều hướng hiệu quả chỉ bằng đầu vào là ảnh chụp màn hình.

    1.037+23Thay đổi số sao trong 7 ngày qua
  • Danh sách tài nguyên Decision Transformer được tuyển chọn (cập nhật liên tục)

    916+0Thay đổi số sao trong 7 ngày qua
  • course-content-dl@NeuromatchAcademy

    Khóa học deep learning NMA

    812+1Thay đổi số sao trong 7 ngày qua
  • POMDPs.jl@JuliaPOMDP

    MDP và POMDP trong Julia - Giao diện để định nghĩa, giải quyết và mô phỏng các quá trình quyết định Markov quan sát được toàn phần và một phần trên không gian rời rạc và liên tục.

    766+1Thay đổi số sao trong 7 ngày qua
  • stable-baselines3-contrib@Stable-Baselines-Team

    Gói đóng góp cho Stable-Baselines3 - Mã học tăng cường (RL) thử nghiệm

    736+5Thay đổi số sao trong 7 ngày qua
  • Đây là dự án về thuật toán tránh chướng ngại vật tự động dựa trên học tăng cường sâu cho UAV.

    730+0Thay đổi số sao trong 7 ngày qua
  • disco_rl@google-deepmind

    Mã nguồn đi kèm cho ấn phẩm Nature "Discovering State-of-the-art Reinforcement Algorithms".

    728+2Thay đổi số sao trong 7 ngày qua
  • Danh sách các tài nguyên học tập về Reinforcement Learning (RL) chất lượng (được cập nhật liên tục)

    723+0Thay đổi số sao trong 7 ngày qua
  • UAV-DDPG@fangvv

    Mã nguồn cho bài báo "Tối ưu hóa giảm tải tính toán cho điện toán biên di động hỗ trợ UAV: Phương pháp Deep Deterministic Policy Gradient".

    722+1Thay đổi số sao trong 7 ngày qua
  • Rofunc@Skylark0924

    🤖 Gói Python quy trình đầy đủ cho học tập từ minh họa và điều khiển robot.

    720+1Thay đổi số sao trong 7 ngày qua
  • Danh sách các bài báo nghiên cứu về tìm kiếm cây Monte Carlo kèm theo các bản triển khai

    715+1Thay đổi số sao trong 7 ngày qua
  • Thư viện PyTorch để xây dựng các tác nhân học tăng cường sâu

    657+0Thay đổi số sao trong 7 ngày qua
  • dLLM-RL@Gen-Verse

    [ICLR 2026] Mã nguồn chính thức cho TraceRL: Cách mạng hóa quá trình hậu huấn luyện cho Diffusion LLM, hỗ trợ dòng TraDo SOTA.

    520+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề