reinforcement-learning
Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.
- #211
Thư viện Python cho Học tăng cường.
★ 944+0Thay đổi số sao trong 7 ngày qua - #212
UniRL là một framework dành cho Học tăng cường mô hình đa phương thức thống nhất
★ 939+18Thay đổi số sao trong 7 ngày qua - #213
🦁 Cơ sở mã thân thiện với nghiên cứu để thử nghiệm nhanh chóng học tăng cường đa tác nhân trong JAX
★ 934+2Thay đổi số sao trong 7 ngày qua - #214
UniLab: Kiến trúc không đồng nhất cho học tăng cường (RL) robot vượt ra ngoài các mô hình thống trị bởi GPU.
★ 926+25Thay đổi số sao trong 7 ngày qua - #215
Nền tảng Tối ưu hóa Tài nguyên Đa tác nhân (MARO) là một ví dụ về Học tăng cường dạng dịch vụ (RaaS) cho các bài toán tối ưu hóa tài nguyên trong thế giới thực.
★ 923+2Thay đổi số sao trong 7 ngày qua - #216
Tóm tắt các bài báo và blog chính về diffusion models để tìm hiểu về chủ đề này. Danh sách chi tiết tất cả các bài báo nghiên cứu về diffusion robotics đã được xuất bản.
★ 920+1Thay đổi số sao trong 7 ngày qua - #217
Môi trường PyBullet CartPole và Quadrotor—với động lực học biểu tượng CasADi a priori—dành cho điều khiển dựa trên học máy và RL
★ 917+4Thay đổi số sao trong 7 ngày qua - #218
Danh sách tài nguyên Decision Transformer được tuyển chọn (cập nhật liên tục)
★ 917+0Thay đổi số sao trong 7 ngày qua - #219
👉 Tài nguyên CARLA như hướng dẫn, blog, mã nguồn và v.v. https://github.com/carla-simulator/carla
★ 915-1Thay đổi số sao trong 7 ngày qua - #220★ 905+1Thay đổi số sao trong 7 ngày qua
- #221
Danh sách tổng hợp các tài nguyên Deep Reinforcement Learning tuyệt vời.
★ 900+1Thay đổi số sao trong 7 ngày qua - #222
Một thư viện PyTorch dành cho mọi khía cạnh của Học tăng cường (RL) trong Tối ưu hóa tổ hợp (CO).
★ 900+1Thay đổi số sao trong 7 ngày qua - #223
Transformers là các mô hình thế giới hiệu quả về mẫu. ICLR 2023, nằm trong top 5% nổi bật.
★ 899+0Thay đổi số sao trong 7 ngày qua - #224
Tien Kung-Lab: Quy trình làm việc IsaacLab trực tiếp cho robot đi bằng chân
★ 884+11Thay đổi số sao trong 7 ngày qua - #225★ 875—Thay đổi số sao trong 7 ngày qua
- #226★ 861+2Thay đổi số sao trong 7 ngày qua
- #227
Công cụ thiết kế phân tử AI cho thiết kế de novo, scaffold hopping, thay thế nhóm R, thiết kế linker và tối ưu hóa phân tử.
★ 854+3Thay đổi số sao trong 7 ngày qua - #228
[CoRL 2024] HumanPlus: Mô phỏng và bắt chước hành vi con người cho robot hình người
★ 849+0Thay đổi số sao trong 7 ngày qua - #229★ 848+3Thay đổi số sao trong 7 ngày qua
- #230★ 841+0Thay đổi số sao trong 7 ngày qua
- #231
Bộ sưu tập các công cụ AI, API, tập dữ liệu và tài nguyên học tập chất lượng cao miễn phí về machine learning, deep learning, generative AI, NLP và khoa học dữ liệu. Được thiết kế để giúp các nhà phát triển, nhà nghiên cứu và người sáng tạo khám phá và xây dựng với AI nhanh hơn.
★ 841+28Thay đổi số sao trong 7 ngày qua - #232
Triển khai các thuật toán contextual bandits bằng Python
★ 839+1Thay đổi số sao trong 7 ngày qua - #233
Kho lưu trữ này chứa các cơ sở cho học tăng cường an toàn (safe reinforcement learning).
★ 814+0Thay đổi số sao trong 7 ngày qua - #234
🚀🚀🚀 Bộ sưu tập các dự án công khai ấn tượng về Mô hình ngôn ngữ lớn (LLM), Mô hình ngôn ngữ thị giác (VLM), Hành động ngôn ngữ thị giác (VLA), Nội dung do AI tạo (AIGC), cùng các bộ dữ liệu và ứng dụng liên quan.
★ 813+1Thay đổi số sao trong 7 ngày qua - #235
Bộ sưu tập các bài báo, báo cáo kỹ thuật, khung làm việc và công cụ được tuyển chọn cho việc chưng cất theo chính sách (OPD) của các mô hình ngôn ngữ lớn
★ 803+34Thay đổi số sao trong 7 ngày qua - #236
Danh sách tổng hợp các framework, bài báo, phần mềm và tài nguyên tuyệt vời về NVIDIA Isaac Gym
★ 797+2Thay đổi số sao trong 7 ngày qua - #237
MobileGym: Nền tảng mô phỏng có thể kiểm chứng và song song hóa cao cho nghiên cứu tác nhân GUI di động · Trình mô phỏng Android chạy trên trình duyệt · Đánh giá có thể kiểm chứng · Đào tạo RL trực tuyến có khả năng mở rộng
★ 787+10Thay đổi số sao trong 7 ngày qua - #238
BFM_Zero: Mô hình nền tảng hành vi có thể nhắc lệnh (promptable) cho điều khiển robot hình người sử dụng học tăng cường không giám sát
★ 779+17Thay đổi số sao trong 7 ngày qua - #239
MDP và POMDP trong Julia - Giao diện để định nghĩa, giải quyết và mô phỏng các quá trình quyết định Markov quan sát được toàn phần và một phần trên không gian rời rạc và liên tục.
★ 767+1Thay đổi số sao trong 7 ngày qua - #240★ 766+1Thay đổi số sao trong 7 ngày qua