reinforcement-learning
Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.
- #181
Thuật toán Asynchronous Advantage Actor-Critic (A3C) cho Super Mario Bros
★ 1.111-1Thay đổi số sao trong 7 ngày qua - #182★ 1.102+2Thay đổi số sao trong 7 ngày qua
- #183
Thư viện Reinforcement Learning (RL) dạng mô-đun (được triển khai bằng PyTorch, JAX và NVIDIA Warp) hỗ trợ Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground và các môi trường khác.
★ 1.095+2Thay đổi số sao trong 7 ngày qua - #184
Thư viện cung cấp các tác vụ điều khiển bàn tay khéo léo kép thông qua Isaac Gym
★ 1.093+6Thay đổi số sao trong 7 ngày qua - #185★ 1.083+2Thay đổi số sao trong 7 ngày qua
- #186
Một bản fork của gym-retro với các trò chơi, trình giả lập và nền tảng được hỗ trợ bổ sung.
★ 1.079+396Thay đổi số sao trong 7 ngày qua - #187
Danh mục thuật toán học tăng cường ngoại tuyến (offline-rl)
★ 1.078+3Thay đổi số sao trong 7 ngày qua - #188
Môi trường học tăng cường cho điều khiển tín hiệu giao thông với SUMO. Tương thích với Gymnasium, PettingZoo và các thư viện RL phổ biến.
★ 1.074+3Thay đổi số sao trong 7 ngày qua - #189
Sách / PDF / EPUB cho các lĩnh vực lập trình khác nhau. ĐỌC, PHÁT TRIỂN VÀ TẬN HƯỞNG 😊😊😊😊
★ 1.065+5Thay đổi số sao trong 7 ngày qua - #190
Hướng dẫn thiết yếu để cập nhật tin tức về AI/ML/DL/CV
★ 1.063+0Thay đổi số sao trong 7 ngày qua - #191
Stack cải tiến liên tục dành cho Agent. Dữ liệu môi trường và các bài đánh giá của chúng tôi hỗ trợ cải thiện và giám sát agent.
★ 1.060+2Thay đổi số sao trong 7 ngày qua - #192
Mã nguồn của bài báo "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Chúng tôi đề xuất nâng cao tính ứng dụng thực tế của bài toán đóng gói thùng 3D trực tuyến (BPP) thông qua việc học trên cây cấu hình đóng gói phân cấp, giúp mô hình học tăng cường sâu (DRL) dễ dàng xử lý các ràng buộc thực tế và hoạt động hiệu quả ngay cả với không gian giải pháp liên tục.
★ 1.047+1Thay đổi số sao trong 7 ngày qua - #193
Lộ trình học tập toàn diện nhất dành cho Kỹ sư AI Agent · Thành thạo kỹ thuật AI từ con số không · 20 giai đoạn 503 bài học · Bản dịch tiếng Trung đầy đủ + trang web đi kèm + video giải thích bằng hoạt hình · Hướng dẫn trở thành Kỹ sư AI Agent
★ 1.041+38Thay đổi số sao trong 7 ngày qua - #194★ 1.041+1Thay đổi số sao trong 7 ngày qua
- #195★ 1.033+3Thay đổi số sao trong 7 ngày qua
- #196
Mã nguồn cho cuốn sách "Reinforcement Learning: Theory and Python Implementation"
★ 1.033+3Thay đổi số sao trong 7 ngày qua - #197
Học tăng cường đồng bộ và bất đồng bộ thông lượng cao
★ 1.022+1Thay đổi số sao trong 7 ngày qua - #198
Deep RL cho điều khiển MPC trong chuyển động của Robot bốn chân
★ 1.022+2Thay đổi số sao trong 7 ngày qua - #199
Bộ sưu tập tài liệu và các bài báo kinh điển cũng như tiên tiến nhất trong ngành công nghiệp quảng cáo và hệ thống gợi ý / Must-read Papers on Recommendation System and CTR Prediction
★ 1.016+0Thay đổi số sao trong 7 ngày qua - #200
Môi trường benchmark cho hiệu suất hợp tác toàn diện giữa con người và AI.
★ 1.003+5Thay đổi số sao trong 7 ngày qua - #201
Tài liệu Game AI tuyệt vời về Học tăng cường đa tác nhân (Multi-Agent Reinforcement Learning)
★ 979+2Thay đổi số sao trong 7 ngày qua - #202
Một mô hình chỉnh sửa âm thanh Học tăng cường dựa trên LLM 3B tham số mạnh mẽ, xuất sắc trong việc chỉnh sửa cảm xúc, phong cách nói và ngôn ngữ cận lời, đồng thời tích hợp tính năng chuyển đổi văn bản thành giọng nói zero-shot mạnh mẽ
★ 972+2Thay đổi số sao trong 7 ngày qua - #203
Bộ sưu tập các môi trường mô phỏng robot dành cho học tăng cường
★ 963+1Thay đổi số sao trong 7 ngày qua - #204
Đại học Mã nguồn mở Học máy
★ 955+0Thay đổi số sao trong 7 ngày qua - #205★ 955+60Thay đổi số sao trong 7 ngày qua
- #206
Danh sách thiết kế phân tử và vật liệu sử dụng Generative AI và Deep Learning
★ 952+1Thay đổi số sao trong 7 ngày qua - #207
Tối ưu hóa học tăng cường với RLOps. Các thuật toán và công cụ RL tiên tiến, với tốc độ huấn luyện nhanh hơn 10 lần nhờ tối ưu hóa siêu tham số tiến hóa.
★ 950+4Thay đổi số sao trong 7 ngày qua - #208★ 947+1Thay đổi số sao trong 7 ngày qua
- #209
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 947—Thay đổi số sao trong 7 ngày qua - #210
Thư viện Python cho Học tăng cường.
★ 944+0Thay đổi số sao trong 7 ngày qua