reinforcement-learning
Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.
- #121
Rainbow là tất cả những gì bạn cần! Hướng dẫn từng bước từ DQN đến Rainbow
★ 2.032+0Thay đổi số sao trong 7 ngày qua - #122★ 2.025+4Thay đổi số sao trong 7 ngày qua
- #123
Advanced Deep Learning với Keras, xuất bản bởi Packt
★ 2.023+0Thay đổi số sao trong 7 ngày qua - #124
Trung tâm tài nguyên cho nhà phát triển cho NVIDIA Nemotron — Tài nguyên một điểm dừng cho các công thức huấn luyện, hướng dẫn sử dụng, tập dữ liệu và các ví dụ tham chiếu end-to-end hoàn chỉnh để xây dựng với các mô hình Nemotron
★ 2.015+18Thay đổi số sao trong 7 ngày qua - #125
🚀 Tài nguyên AI MIỄN PHÍ - 🎓 Khóa học, 👷 Việc làm, 📝 Blog, 🔬 Nghiên cứu AI và nhiều hơn nữa - dành cho tất cả mọi người!
★ 1.975+9Thay đổi số sao trong 7 ngày qua - #126★ 1.972+1Thay đổi số sao trong 7 ngày qua
- #127
Cài đặt tất cả các thuật toán RL theo cách đơn giản hơn
★ 1.929+7Thay đổi số sao trong 7 ngày qua - #128
Môi trường giao dịch và kiểm thử ngược để huấn luyện tác nhân học tăng cường hoặc thuật toán dựa trên quy tắc đơn giản.
★ 1.915+2Thay đổi số sao trong 7 ngày qua - #129
RoboVerse: Hướng tới nền tảng, tập dữ liệu và chuẩn đo lường thống nhất cho học máy robot có khả năng mở rộng và tổng quát hóa
★ 1.851+11Thay đổi số sao trong 7 ngày qua - #130
Một số sách và PDF liên quan đến AI tuyệt vời để học tập và tải xuống, đồng thời áp dụng một số mô hình thử nghiệm để học tập
★ 1.799+2Thay đổi số sao trong 7 ngày qua - #131★ 1.789+1Thay đổi số sao trong 7 ngày qua
- #132★ 1.722+0Thay đổi số sao trong 7 ngày qua
- #133
Mã huấn luyện học tăng cường cho AgiBot X1.
★ 1.698-1Thay đổi số sao trong 7 ngày qua - #134★ 1.695+0Thay đổi số sao trong 7 ngày qua
- #135
Deep Neuroevolution
★ 1.666-1Thay đổi số sao trong 7 ngày qua - #136
[NeurIPS 2023 Spotlight] LightZero: Một chuẩn mực thống nhất cho Tìm kiếm cây Monte Carlo trong các kịch bản quyết định tuần tự tổng quát (MCTS tuyệt vời)
★ 1.642+4Thay đổi số sao trong 7 ngày qua - #137
Safe RLHF: Căn chỉnh giá trị có ràng buộc thông qua Học tăng cường an toàn từ phản hồi của con người
★ 1.613+1Thay đổi số sao trong 7 ngày qua - #138
[IEEE RA-L'25] NavRL: Học bay an toàn trong môi trường động (NVIDIA Isaac/Python/ROS1/ROS2)
★ 1.599+7Thay đổi số sao trong 7 ngày qua - #139
Gói mã nguồn mở cho phép các nhà sáng tạo trò chơi điện tử, nhà nghiên cứu AI và người có sở thích cơ hội học hỏi các hành vi phức tạp cho Nhân vật không phải người chơi (NPC) hoặc tác nhân của họ
★ 1.578+1Thay đổi số sao trong 7 ngày qua - #140
Khóa học miễn phí đưa bạn từ con số không đến chuyên gia Reinforcement Learning 🦸🏻🦸🏽
★ 1.570+0Thay đổi số sao trong 7 ngày qua - #141
AgentEvolver: Hướng tới hệ thống tác nhân tự tiến hóa hiệu quả
★ 1.552+3Thay đổi số sao trong 7 ngày qua - #142
🚀🀄️ Một AI nhanh và mạnh cho mạt chược Nhật Bản (riichi mahjong), được hỗ trợ bởi Rust và học tăng cường sâu.
★ 1.539+8Thay đổi số sao trong 7 ngày qua - #143
Danh sách chọn lọc các tài nguyên Trí tuệ Nhân tạo tốt nhất
★ 1.522+2Thay đổi số sao trong 7 ngày qua - #144
Công cụ thực thi môi trường song song hiệu suất cao dựa trên C++ (môi trường được vector hóa) cho các môi trường RL chung.
★ 1.513+2Thay đổi số sao trong 7 ngày qua - #145
Dành cho deep RL và tương lai của AI.
★ 1.513+0Thay đổi số sao trong 7 ngày qua - #146
[NeurIPS 2025 Spotlight] Môi trường suy luận cho học tăng cường với phần thưởng có thể kiểm chứng.
★ 1.500+3Thay đổi số sao trong 7 ngày qua - #147
Danh sách chọn lọc các liên kết tuyệt vời và thư viện phần mềm hữu ích cho robot.
★ 1.483+3Thay đổi số sao trong 7 ngày qua - #148
Một bộ sưu tập các Jupyter notebook tham chiếu và ứng dụng AI/ML demo cho các trường hợp sử dụng trong doanh nghiệp: tiếp thị, định giá, chuỗi cung ứng, sản xuất thông minh và hơn thế nữa.
★ 1.453+1Thay đổi số sao trong 7 ngày qua - #149
TextWorld là một môi trường học tập dạng hộp cát (sandbox) để đào tạo và đánh giá các agent học tăng cường (RL) trên các trò chơi dựa trên văn bản.
★ 1.442+1Thay đổi số sao trong 7 ngày qua - #150
Các công cụ huấn luyện và triển khai Sim-to-real RL cho robot Unitree Go1.
★ 1.440+0Thay đổi số sao trong 7 ngày qua