Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · reinforcement-learning

reinforcement-learning

Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.

Kho mã
305
Tổng số sao
1.292.198
Số sao trung bình
4.237
Tỷ trọng
0,07%

Những chủ đề thường xuất hiện cùng reinforcement-learning trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ reinforcement-learning.

  • agent-apprenticeship@ray-r-ren

    Hệ sinh thái sống động nơi các AI agent hoàn thành nhiệm vụ thông qua các vòng lặp quy trình làm việc, cải thiện thông qua thực thi lặp đi lặp lại, được đánh giá bởi các agent cố vấn hoặc con người trong vòng lặp, và biến công việc đã hoàn thành thành kinh nghiệm làm việc và dữ liệu có thể tái sử dụng để cải thiện các agent trong tương lai.

    1.334
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    697
  • 人形机器人运动智能论文、开源项目、产业与求职知识库

    502
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • OraRL@HVision-NKU

    🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.

    152
  • Danh sách các khóa học Khoa học Máy tính có kèm video bài giảng.

    83.389+163Thay đổi số sao trong 7 ngày qua
  • unsloth@unslothai

    Giao diện người dùng cục bộ để chạy và huấn luyện LLM cùng các mô hình khuếch tán, bao gồm Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX và nhiều hơn nữa.

    75.515+337Thay đổi số sao trong 7 ngày qua
  • 🧑‍🏫 Hơn 60 bản cài đặt/hướng dẫn các bài báo về deep learning kèm ghi chú chi tiết 📝; bao gồm transformer (gốc, xl, switch, feedback, vit, ...), trình tối ưu hóa (adam, adabelief, sophia, ...), gan (cyclegan, stylegan2, ...), 🎮 học tăng cường (ppo, dqn), capsnet, chưng cất, ... 🧠

    67.389+21Thay đổi số sao trong 7 ngày qua
  • Học nó. Xây dựng nó. Phát hành nó cho mọi người.

    52.098+1.149Thay đổi số sao trong 7 ngày qua
  • ai-agent-book@bojieli

    Kho lưu trữ mã nguồn mở chính của cuốn sách 《Hiểu sâu về AI Agent: Nguyên lý thiết kế và Thực hành kỹ thuật》 (Tác giả: Lý Bác Kiệt): Toàn bộ nội dung sách, bản PDF đã biên dịch và mã nguồn đi kèm theo từng chương

    44.381+1.022Thay đổi số sao trong 7 ngày qua
  • ray@ray-project

    Ray là một công cụ tính toán AI. Ray bao gồm một runtime phân tán cốt lõi và một bộ thư viện AI để tăng tốc khối lượng công việc ML.

    43.688+41Thay đổi số sao trong 7 ngày qua
  • sglang@sgl-project

    SGLang là framework phục vụ hiệu suất cao cho các mô hình ngôn ngữ lớn và mô hình đa phương thức.

    33.538+791Thay đổi số sao trong 7 ngày qua
  • applied-ml@eugeneyan

    📚 Tài liệu nghiên cứu và blog kỹ thuật từ các công ty chia sẻ về khoa học dữ liệu và machine learning trong môi trường production.

    30.107+10Thay đổi số sao trong 7 ngày qua
  • d2l-en@d2l-ai

    Sách học sâu tương tác với mã đa framework, toán học và các cuộc thảo luận. Được áp dụng tại 500 trường đại học từ 70 quốc gia bao gồm Stanford, MIT, Harvard và Cambridge.

    29.512+30Thay đổi số sao trong 7 ngày qua
  • FinGPT@AI4Finance-Foundation

    FinGPT: Mô hình ngôn ngữ lớn tài chính mã nguồn mở! Đổi mới 🔥 Chúng tôi phát hành mô hình đã huấn luyện trên HuggingFace.

    21.201+17Thay đổi số sao trong 7 ngày qua
  • machine-learning-for-trading@stefan-jansen

    Mã nguồn cho Machine Learning for Trading, phiên bản thứ 3 — từ tìm kiếm nguồn dữ liệu đến thực thi trực tiếp.

    20.762+43Thay đổi số sao trong 7 ngày qua
  • ml-agents@Unity-Technologies

    Bộ công cụ Unity Machine Learning Agents (ML-Agents) là một dự án mã nguồn mở cho phép các trò chơi và mô phỏng đóng vai trò là môi trường để huấn luyện các tác nhân thông minh bằng học tăng cường sâu và học bắt chước.

    19.655+2Thay đổi số sao trong 7 ngày qua
  • agent-lightning@microsoft

    Trình huấn luyện tuyệt đối để thắp sáng các AI agent.

    17.959+56Thay đổi số sao trong 7 ngày qua
  • Đây là trang chủ của cuốn sách mới có tựa đề "Nền tảng toán học của học tăng cường" (Mathematical Foundations of Reinforcement Learning).

    17.663+53Thay đổi số sao trong 7 ngày qua
  • leedl-tutorial@datawhalechina

    Hướng dẫn Học sâu của Lý Hoành Nghị (được thầy Lý Hoành Nghị khuyến nghị 👍, Sách Táo 🍎), địa chỉ tải PDF: https://github.com/datawhalechina/leedl-tutorial/releases

    16.747+8Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các khóa học, sách, bài giảng video và tài liệu nghiên cứu về Trí tuệ nhân tạo (AI).

    16.306+44Thay đổi số sao trong 7 ngày qua
  • Bản cài đặt bằng Python của Reinforcement Learning: An Introduction

    14.758+0Thay đổi số sao trong 7 ngày qua
  • bullet3@bulletphysics

    Bullet Physics SDK: phát hiện va chạm thời gian thực và mô phỏng đa vật lý cho VR, trò chơi, hiệu ứng hình ảnh, robot, học máy, v.v.

    14.711+7Thay đổi số sao trong 7 ngày qua
  • easy-rl@datawhalechina

    Hướng dẫn học tăng cường bằng tiếng Trung (Sách Nấm 🍄), địa chỉ đọc trực tuyến: https://datawhalechina.github.io/easy-rl/

    14.600+8Thay đổi số sao trong 7 ngày qua
  • Phiên bản PyTorch của Stable Baselines, các bản cài đặt đáng tin cậy của thuật toán học tăng cường.

    13.758+21Thay đổi số sao trong 7 ngày qua
  • Đắm mình vào Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision và NLP thông qua các bài giảng thú vị này!

    12.939+3Thay đổi số sao trong 7 ngày qua
  • Gymnasium@Farama-Foundation

    Một API chuẩn cho môi trường học tăng cường đơn tác nhân, kèm theo các môi trường tham chiếu phổ biến và các tiện ích liên quan (trước đây là Gym)

    12.451+21Thay đổi số sao trong 7 ngày qua
  • wandb@wandb

    Nền tảng nhà phát triển AI. Sử dụng Weights & Biases để huấn luyện và tinh chỉnh mô hình, đồng thời quản lý mô hình từ giai đoạn thử nghiệm đến sản xuất.

    11.249+4Thay đổi số sao trong 7 ngày qua
  • amazon-sagemaker-examples@aws

    Notebook 📓 Jupyter mẫu minh họa cách xây dựng, huấn luyện và triển khai các mô hình học máy sử dụng 🧠 Amazon SageMaker.

    10.983+2Thay đổi số sao trong 7 ngày qua
  • ART@OpenPipe

    Agent Reinforcement Trainer: huấn luyện các agent nhiều bước cho các tác vụ thực tế bằng GRPO. Cung cấp đào tạo tại chỗ cho các agent của bạn. Học tăng cường (Reinforcement learning) cho Qwen3.6, GPT-OSS, Llama và nhiều mô hình khác!

    10.689+10Thay đổi số sao trong 7 ngày qua
  • cleanrl@vwxyzjn

    Triển khai tệp đơn chất lượng cao cho các thuật toán Deep Reinforcement Learning với các tính năng thân thiện với nghiên cứu (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

    10.358+19Thay đổi số sao trong 7 ngày qua
  • OpenRLHF@OpenRLHF

    Một khung làm việc Agentic RL dễ sử dụng, có khả năng mở rộng và hiệu năng cao dựa trên Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9.969+9Thay đổi số sao trong 7 ngày qua
  • Hướng dẫn học tăng cường đơn giản, tài liệu giảng dạy AI tiếng Trung của MoFan Python

    9.508-2Thay đổi số sao trong 7 ngày qua
  • Sana@NVlabs

    SANA: Tổng hợp hình ảnh độ phân giải cao hiệu quả với Linear Diffusion Transformer

    8.925+37Thay đổi số sao trong 7 ngày qua
  • machine_learning_examples@lazyprogrammer

    Bộ sưu tập các ví dụ và hướng dẫn về học máy.

    8.917+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề