deep-reinforcement-learning
Các kho mã nguồn mở đang theo dõi được gắn thẻ deep-reinforcement-learning, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng deep-reinforcement-learning trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ deep-reinforcement-learning.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Bộ công cụ Unity Machine Learning Agents (ML-Agents) là một dự án mã nguồn mở cho phép các trò chơi và mô phỏng đóng vai trò là môi trường để huấn luyện các tác nhân thông minh bằng học tăng cường sâu và học bắt chước.
★ 19.655+2Thay đổi số sao trong 7 ngày qua - #2
Trình mô phỏng mã nguồn mở dành cho xe tự hành được xây dựng trên Unreal Engine / Unity, từ Microsoft AI & Research
★ 18.434+8Thay đổi số sao trong 7 ngày qua - #3★ 16.200+52Thay đổi số sao trong 7 ngày qua
- #4
Hướng dẫn học tăng cường bằng tiếng Trung (Sách Nấm 🍄), địa chỉ đọc trực tuyến: https://datawhalechina.github.io/easy-rl/
★ 14.600+8Thay đổi số sao trong 7 ngày qua - #5★ 14.352+17Thay đổi số sao trong 7 ngày qua
- #6
Đắm mình vào Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision và NLP thông qua các bài giảng thú vị này!
★ 12.939+3Thay đổi số sao trong 7 ngày qua - #7
Các hướng dẫn, bài tập và cuộc thi cho các khóa học liên quan đến Deep Learning của MIT.
★ 10.453-1Thay đổi số sao trong 7 ngày qua - #8
Triển khai tệp đơn chất lượng cao cho các thuật toán Deep Reinforcement Learning với các tính năng thân thiện với nghiên cứu (PPO, DQN, C51, DDPG, TD3, SAC, PPG)
★ 10.358+19Thay đổi số sao trong 7 ngày qua - #9
(⌐■_■) - Học tăng cường sâu (Deep Reinforcement Learning) trang bị cho bettercap để bẻ khóa WiFi.
★ 9.193+1Thay đổi số sao trong 7 ngày qua - #10
Tài liệu thực hành cho MIT 6.S191: Giới thiệu về Deep Learning
★ 8.770+8Thay đổi số sao trong 7 ngày qua - #11
Hack Flappy Bird sử dụng Học tăng cường sâu (Deep Q-learning).
★ 6.819+0Thay đổi số sao trong 7 ngày qua - #12
Khóa học về học tăng cường (reinforcement learning) trong thực tế
★ 6.566+0Thay đổi số sao trong 7 ngày qua - #13
Kho lưu trữ cho chương trình Deep Reinforcement Learning Nanodegree
★ 5.176+0Thay đổi số sao trong 7 ngày qua - #14
Kho lưu trữ này chứa Khóa học Deep Reinforcement Learning của Hugging Face.
★ 5.006+10Thay đổi số sao trong 7 ngày qua - #15
Sách "Mô hình ngôn ngữ lớn" tác giả: Triệu Hâm, Lý Quân Nghị, Châu Côn, Đường Thiên Nhất, Văn Kế Vinh
★ 4.557+3Thay đổi số sao trong 7 ngày qua - #16
Danh sách tài nguyên học tăng cường có phản hồi từ con người được tuyển chọn (cập nhật liên tục)
★ 4.424+2Thay đổi số sao trong 7 ngày qua - #17
Các ví dụ Học tăng cường tối giản và rõ ràng
★ 3.660+0Thay đổi số sao trong 7 ngày qua - #18
FinRL-X: Cơ sở hạ tầng mô-đun gốc AI dành cho giao dịch định lượng
★ 3.657+50Thay đổi số sao trong 7 ngày qua - #19
Học tăng cường / Bot AI trong các trò chơi bài (Poker) - Blackjack, Leduc, Texas, DouDizhu, Mahjong, UNO.
★ 3.541+0Thay đổi số sao trong 7 ngày qua - #20★ 3.452+3Thay đổi số sao trong 7 ngày qua
- #21
Triển khai PyTorch sạch sẽ, mạnh mẽ và thống nhất của các thuật toán Deep Reinforcement Learning (DRL) phổ biến (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3.440+3Thay đổi số sao trong 7 ngày qua - #22
Tensorforce: thư viện TensorFlow dành cho học tăng cường ứng dụng
★ 3.305+0Thay đổi số sao trong 7 ngày qua - #23
Công cụ chơi cờ vua bằng mạng nơ-ron mã nguồn mở với khả năng tăng tốc GPU và hỗ trợ phần cứng rộng rãi.
★ 3.197+1Thay đổi số sao trong 7 ngày qua - #24
Thư viện cấp cao dạng module để huấn luyện các tác nhân AI tương tác qua lại trên nhiều tác vụ và môi trường khác nhau.
★ 3.117+6Thay đổi số sao trong 7 ngày qua - #25
Khung huấn luyện cho các agent học tăng cường Stable Baselines3, bao gồm tối ưu hóa siêu tham số và các agent được huấn luyện sẵn.
★ 2.873+1Thay đổi số sao trong 7 ngày qua - #26
MuZero
★ 2.865+2Thay đổi số sao trong 7 ngày qua - #27
Khóa học PPO x Family DRL (Khóa học công khai nhập môn Trí tuệ Quyết định: 8 bài học giúp bạn hiểu rõ lý thuyết thuật toán, làm sạch logic mã nguồn và làm chủ ứng dụng AI quyết định)
★ 2.616+2Thay đổi số sao trong 7 ngày qua - #28
Bản cài đặt tối giản của thuật toán Proximal Policy Optimization (PPO) với hàm mục tiêu bị cắt xén trong PyTorch
★ 2.381+6Thay đổi số sao trong 7 ngày qua - #29★ 2.293+0Thay đổi số sao trong 7 ngày qua
- #30
FinRL-Meta: Bộ dữ liệu động và môi trường thị trường cho FinRL.
★ 1.934+4Thay đổi số sao trong 7 ngày qua