Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · reinforcement-learning

reinforcement-learning

Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.

304 kho mã
  • Thuật toán Asynchronous Advantage Actor-Critic (A3C) cho Super Mario Bros

    1.111-1Thay đổi số sao trong 7 ngày qua
  • purejaxrl@luchris429

    Các cài đặt Jax RL đầu cuối cực nhanh

    1.102+2Thay đổi số sao trong 7 ngày qua
  • skrl@Toni-SM

    Thư viện Reinforcement Learning (RL) dạng mô-đun (được triển khai bằng PyTorch, JAX và NVIDIA Warp) hỗ trợ Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground và các môi trường khác.

    1.095+2Thay đổi số sao trong 7 ngày qua
  • DexterousHands@PKU-MARL

    Thư viện cung cấp các tác vụ điều khiển bàn tay khéo léo kép thông qua Isaac Gym

    1.093+6Thay đổi số sao trong 7 ngày qua
  • xuance@agi-brain

    XuanCe: Thư viện Học Tăng cường Sâu Toàn diện và Thống nhất

    1.083+2Thay đổi số sao trong 7 ngày qua
  • Stable-Retro@Farama-Foundation

    Một bản fork của gym-retro với các trò chơi, trình giả lập và nền tảng được hỗ trợ bổ sung.

    1.079+396Thay đổi số sao trong 7 ngày qua
  • Danh mục thuật toán học tăng cường ngoại tuyến (offline-rl)

    1.078+3Thay đổi số sao trong 7 ngày qua
  • sumo-rl@LucasAlegre

    Môi trường học tăng cường cho điều khiển tín hiệu giao thông với SUMO. Tương thích với Gymnasium, PettingZoo và các thư viện RL phổ biến.

    1.074+3Thay đổi số sao trong 7 ngày qua
  • Books@Rishabh-creator601

    Sách / PDF / EPUB cho các lĩnh vực lập trình khác nhau. ĐỌC, PHÁT TRIỂN VÀ TẬN HƯỞNG 😊😊😊😊

    1.065+5Thay đổi số sao trong 7 ngày qua
  • Hướng dẫn thiết yếu để cập nhật tin tức về AI/ML/DL/CV

    1.063+0Thay đổi số sao trong 7 ngày qua
  • judgeval@JudgmentLabs

    Stack cải tiến liên tục dành cho Agent. Dữ liệu môi trường và các bài đánh giá của chúng tôi hỗ trợ cải thiện và giám sát agent.

    1.060+2Thay đổi số sao trong 7 ngày qua
  • Online-3D-BPP-PCT@alexfrom0815

    Mã nguồn của bài báo "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Chúng tôi đề xuất nâng cao tính ứng dụng thực tế của bài toán đóng gói thùng 3D trực tuyến (BPP) thông qua việc học trên cây cấu hình đóng gói phân cấp, giúp mô hình học tăng cường sâu (DRL) dễ dàng xử lý các ràng buộc thực tế và hoạt động hiệu quả ngay cả với không gian giải pháp liên tục.

    1.047+1Thay đổi số sao trong 7 ngày qua
  • Lộ trình học tập toàn diện nhất dành cho Kỹ sư AI Agent · Thành thạo kỹ thuật AI từ con số không · 20 giai đoạn 503 bài học · Bản dịch tiếng Trung đầy đủ + trang web đi kèm + video giải thích bằng hoạt hình · Hướng dẫn trở thành Kỹ sư AI Agent

    1.041+38Thay đổi số sao trong 7 ngày qua
  • GPTSwarm@metauto-ai

    🐝 Các tác nhân tự cải thiện đầu tiên với RL / Tối ưu hóa Prompting

    1.041+1Thay đổi số sao trong 7 ngày qua
  • rl-tools@rl-tools

    Thư viện học tăng cường sâu nhanh nhất

    1.033+3Thay đổi số sao trong 7 ngày qua
  • rl-book@ZhiqingXiao

    Mã nguồn cho cuốn sách "Reinforcement Learning: Theory and Python Implementation"

    1.033+3Thay đổi số sao trong 7 ngày qua
  • sample-factory@alex-petrenko

    Học tăng cường đồng bộ và bất đồng bộ thông lượng cao

    1.022+1Thay đổi số sao trong 7 ngày qua
  • rl-mpc-locomotion@silvery107

    Deep RL cho điều khiển MPC trong chuyển động của Robot bốn chân

    1.022+2Thay đổi số sao trong 7 ngày qua
  • DeepRec@imsheridan

    Bộ sưu tập tài liệu và các bài báo kinh điển cũng như tiên tiến nhất trong ngành công nghiệp quảng cáo và hệ thống gợi ý / Must-read Papers on Recommendation System and CTR Prediction

    1.016+0Thay đổi số sao trong 7 ngày qua
  • overcooked_ai@HumanCompatibleAI

    Môi trường benchmark cho hiệu suất hợp tác toàn diện giữa con người và AI.

    1.003+5Thay đổi số sao trong 7 ngày qua
  • Tài liệu Game AI tuyệt vời về Học tăng cường đa tác nhân (Multi-Agent Reinforcement Learning)

    979+2Thay đổi số sao trong 7 ngày qua
  • Step-Audio-EditX@stepfun-ai

    Một mô hình chỉnh sửa âm thanh Học tăng cường dựa trên LLM 3B tham số mạnh mẽ, xuất sắc trong việc chỉnh sửa cảm xúc, phong cách nói và ngôn ngữ cận lời, đồng thời tích hợp tính năng chuyển đổi văn bản thành giọng nói zero-shot mạnh mẽ

    972+2Thay đổi số sao trong 7 ngày qua
  • Gymnasium-Robotics@Farama-Foundation

    Bộ sưu tập các môi trường mô phỏng robot dành cho học tăng cường

    963+1Thay đổi số sao trong 7 ngày qua
  • Đại học Mã nguồn mở Học máy

    955+0Thay đổi số sao trong 7 ngày qua
  • verl-omni@verl-project

    Khung huấn luyện RL đa phương thức cho các mô hình diffusion và omni

    955+60Thay đổi số sao trong 7 ngày qua
  • Danh sách thiết kế phân tử và vật liệu sử dụng Generative AI và Deep Learning

    952+1Thay đổi số sao trong 7 ngày qua
  • AgileRL@AgileRL

    Tối ưu hóa học tăng cường với RLOps. Các thuật toán và công cụ RL tiên tiến, với tốc độ huấn luyện nhanh hơn 10 lần nhờ tối ưu hóa siêu tham số tiến hóa.

    950+4Thay đổi số sao trong 7 ngày qua
  • GibsonEnv@StanfordVL

    Môi trường Gibson: Nhận thức thế giới thực cho các tác nhân thể chất

    947+1Thay đổi số sao trong 7 ngày qua
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    947Thay đổi số sao trong 7 ngày qua
  • mushroom-rl@MushroomRL

    Thư viện Python cho Học tăng cường.

    944+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề