Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · reinforcement-learning

reinforcement-learning

Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.

305 kho mã
  • mushroom-rl@MushroomRL

    Thư viện Python cho Học tăng cường.

    944+0Thay đổi số sao trong 7 ngày qua
  • UniRL@Tencent-Hunyuan

    UniRL là một framework dành cho Học tăng cường mô hình đa phương thức thống nhất

    939+18Thay đổi số sao trong 7 ngày qua
  • Mava@instadeepai

    🦁 Cơ sở mã thân thiện với nghiên cứu để thử nghiệm nhanh chóng học tăng cường đa tác nhân trong JAX

    934+2Thay đổi số sao trong 7 ngày qua
  • UniLab@Motphys

    UniLab: Kiến trúc không đồng nhất cho học tăng cường (RL) robot vượt ra ngoài các mô hình thống trị bởi GPU.

    926+25Thay đổi số sao trong 7 ngày qua
  • maro@microsoft

    Nền tảng Tối ưu hóa Tài nguyên Đa tác nhân (MARO) là một ví dụ về Học tăng cường dạng dịch vụ (RaaS) cho các bài toán tối ưu hóa tài nguyên trong thế giới thực.

    923+2Thay đổi số sao trong 7 ngày qua
  • Tóm tắt các bài báo và blog chính về diffusion models để tìm hiểu về chủ đề này. Danh sách chi tiết tất cả các bài báo nghiên cứu về diffusion robotics đã được xuất bản.

    920+1Thay đổi số sao trong 7 ngày qua
  • safe-control-gym@learnsyslab

    Môi trường PyBullet CartPole và Quadrotor—với động lực học biểu tượng CasADi a priori—dành cho điều khiển dựa trên học máy và RL

    917+4Thay đổi số sao trong 7 ngày qua
  • Danh sách tài nguyên Decision Transformer được tuyển chọn (cập nhật liên tục)

    917+0Thay đổi số sao trong 7 ngày qua
  • 👉 Tài nguyên CARLA như hướng dẫn, blog, mã nguồn và v.v. https://github.com/carla-simulator/carla

    915-1Thay đổi số sao trong 7 ngày qua
  • hok_env@tencent-ailab

    Môi trường mở AI cho Honor of Kings của Tencent.

    905+1Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các tài nguyên Deep Reinforcement Learning tuyệt vời.

    900+1Thay đổi số sao trong 7 ngày qua
  • rl4co@ai4co

    Một thư viện PyTorch dành cho mọi khía cạnh của Học tăng cường (RL) trong Tối ưu hóa tổ hợp (CO).

    900+1Thay đổi số sao trong 7 ngày qua
  • iris@eloialonso

    Transformers là các mô hình thế giới hiệu quả về mẫu. ICLR 2023, nằm trong top 5% nổi bật.

    899+0Thay đổi số sao trong 7 ngày qua
  • TienKung-Lab@Open-X-Humanoid

    Tien Kung-Lab: Quy trình làm việc IsaacLab trực tiếp cho robot đi bằng chân

    884+11Thay đổi số sao trong 7 ngày qua
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    875Thay đổi số sao trong 7 ngày qua
  • jumanji@instadeepai

    🕹️ Bộ môi trường học tăng cường có khả năng mở rộng đa dạng trong JAX

    861+2Thay đổi số sao trong 7 ngày qua
  • REINVENT4@MolecularAI

    Công cụ thiết kế phân tử AI cho thiết kế de novo, scaffold hopping, thay thế nhóm R, thiết kế linker và tối ưu hóa phân tử.

    854+3Thay đổi số sao trong 7 ngày qua
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: Mô phỏng và bắt chước hành vi con người cho robot hình người

    849+0Thay đổi số sao trong 7 ngày qua
  • JaxMARL@bold-lab-ai

    Học tăng cường đa tác nhân (Multi-Agent Reinforcement Learning) với JAX

    848+3Thay đổi số sao trong 7 ngày qua
  • openrl@OpenRL-Lab

    Khung làm việc học tăng cường thống nhất

    841+0Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các công cụ AI, API, tập dữ liệu và tài nguyên học tập chất lượng cao miễn phí về machine learning, deep learning, generative AI, NLP và khoa học dữ liệu. Được thiết kế để giúp các nhà phát triển, nhà nghiên cứu và người sáng tạo khám phá và xây dựng với AI nhanh hơn.

    841+28Thay đổi số sao trong 7 ngày qua
  • contextualbandits@david-cortes

    Triển khai các thuật toán contextual bandits bằng Python

    839+1Thay đổi số sao trong 7 ngày qua
  • Kho lưu trữ này chứa các cơ sở cho học tăng cường an toàn (safe reinforcement learning).

    814+0Thay đổi số sao trong 7 ngày qua
  • 🚀🚀🚀 Bộ sưu tập các dự án công khai ấn tượng về Mô hình ngôn ngữ lớn (LLM), Mô hình ngôn ngữ thị giác (VLM), Hành động ngôn ngữ thị giác (VLA), Nội dung do AI tạo (AIGC), cùng các bộ dữ liệu và ứng dụng liên quan.

    813+1Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các bài báo, báo cáo kỹ thuật, khung làm việc và công cụ được tuyển chọn cho việc chưng cất theo chính sách (OPD) của các mô hình ngôn ngữ lớn

    803+34Thay đổi số sao trong 7 ngày qua
  • awesome-isaac-gym@robotlearning123

    Danh sách tổng hợp các framework, bài báo, phần mềm và tài nguyên tuyệt vời về NVIDIA Isaac Gym

    797+2Thay đổi số sao trong 7 ngày qua
  • mobilegym@Purewhiter

    MobileGym: Nền tảng mô phỏng có thể kiểm chứng và song song hóa cao cho nghiên cứu tác nhân GUI di động · Trình mô phỏng Android chạy trên trình duyệt · Đánh giá có thể kiểm chứng · Đào tạo RL trực tuyến có khả năng mở rộng

    787+10Thay đổi số sao trong 7 ngày qua
  • BFM-Zero@LeCAR-Lab

    BFM_Zero: Mô hình nền tảng hành vi có thể nhắc lệnh (promptable) cho điều khiển robot hình người sử dụng học tăng cường không giám sát

    779+17Thay đổi số sao trong 7 ngày qua
  • POMDPs.jl@JuliaPOMDP

    MDP và POMDP trong Julia - Giao diện để định nghĩa, giải quyết và mô phỏng các quá trình quyết định Markov quan sát được toàn phần và một phần trên không gian rời rạc và liên tục.

    767+1Thay đổi số sao trong 7 ngày qua
  • panda-gym@qgallouedec

    Bộ môi trường robot dựa trên công cụ vật lý PyBullet và gymnasium.

    766+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề