reinforcement-learning
Các kho mã nguồn mở đang theo dõi được gắn thẻ reinforcement-learning, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng reinforcement-learning trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ reinforcement-learning.
- #1
Hệ sinh thái sống động nơi các AI agent hoàn thành nhiệm vụ thông qua các vòng lặp quy trình làm việc, cải thiện thông qua thực thi lặp đi lặp lại, được đánh giá bởi các agent cố vấn hoặc con người trong vòng lặp, và biến công việc đã hoàn thành thành kinh nghiệm làm việc và dữ liệu có thể tái sử dụng để cải thiện các agent trong tương lai.
★ 1.334 - #2★ 697
- #3
人形机器人运动智能论文、开源项目、产业与求职知识库
★ 502 - #4
Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.
★ 160 - #5
🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.
★ 152
- #1
Danh sách các khóa học Khoa học Máy tính có kèm video bài giảng.
★ 83.389+163Thay đổi số sao trong 7 ngày qua - #2
Giao diện người dùng cục bộ để chạy và huấn luyện LLM cùng các mô hình khuếch tán, bao gồm Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX và nhiều hơn nữa.
★ 75.515+337Thay đổi số sao trong 7 ngày qua - #3
🧑🏫 Hơn 60 bản cài đặt/hướng dẫn các bài báo về deep learning kèm ghi chú chi tiết 📝; bao gồm transformer (gốc, xl, switch, feedback, vit, ...), trình tối ưu hóa (adam, adabelief, sophia, ...), gan (cyclegan, stylegan2, ...), 🎮 học tăng cường (ppo, dqn), capsnet, chưng cất, ... 🧠
★ 67.389+21Thay đổi số sao trong 7 ngày qua - #4
Học nó. Xây dựng nó. Phát hành nó cho mọi người.
★ 52.098+1.149Thay đổi số sao trong 7 ngày qua - #5
Kho lưu trữ mã nguồn mở chính của cuốn sách 《Hiểu sâu về AI Agent: Nguyên lý thiết kế và Thực hành kỹ thuật》 (Tác giả: Lý Bác Kiệt): Toàn bộ nội dung sách, bản PDF đã biên dịch và mã nguồn đi kèm theo từng chương
★ 44.381+1.022Thay đổi số sao trong 7 ngày qua - #6
Ray là một công cụ tính toán AI. Ray bao gồm một runtime phân tán cốt lõi và một bộ thư viện AI để tăng tốc khối lượng công việc ML.
★ 43.688+41Thay đổi số sao trong 7 ngày qua - #7
SGLang là framework phục vụ hiệu suất cao cho các mô hình ngôn ngữ lớn và mô hình đa phương thức.
★ 33.538+791Thay đổi số sao trong 7 ngày qua - #8
📚 Tài liệu nghiên cứu và blog kỹ thuật từ các công ty chia sẻ về khoa học dữ liệu và machine learning trong môi trường production.
★ 30.107+10Thay đổi số sao trong 7 ngày qua - #9
Sách học sâu tương tác với mã đa framework, toán học và các cuộc thảo luận. Được áp dụng tại 500 trường đại học từ 70 quốc gia bao gồm Stanford, MIT, Harvard và Cambridge.
★ 29.512+30Thay đổi số sao trong 7 ngày qua - #10
FinGPT: Mô hình ngôn ngữ lớn tài chính mã nguồn mở! Đổi mới 🔥 Chúng tôi phát hành mô hình đã huấn luyện trên HuggingFace.
★ 21.201+17Thay đổi số sao trong 7 ngày qua - #11
Mã nguồn cho Machine Learning for Trading, phiên bản thứ 3 — từ tìm kiếm nguồn dữ liệu đến thực thi trực tiếp.
★ 20.762+43Thay đổi số sao trong 7 ngày qua - #12
Bộ công cụ Unity Machine Learning Agents (ML-Agents) là một dự án mã nguồn mở cho phép các trò chơi và mô phỏng đóng vai trò là môi trường để huấn luyện các tác nhân thông minh bằng học tăng cường sâu và học bắt chước.
★ 19.655+2Thay đổi số sao trong 7 ngày qua - #13
Trình huấn luyện tuyệt đối để thắp sáng các AI agent.
★ 17.959+56Thay đổi số sao trong 7 ngày qua - #14
Đây là trang chủ của cuốn sách mới có tựa đề "Nền tảng toán học của học tăng cường" (Mathematical Foundations of Reinforcement Learning).
★ 17.663+53Thay đổi số sao trong 7 ngày qua - #15
Hướng dẫn Học sâu của Lý Hoành Nghị (được thầy Lý Hoành Nghị khuyến nghị 👍, Sách Táo 🍎), địa chỉ tải PDF: https://github.com/datawhalechina/leedl-tutorial/releases
★ 16.747+8Thay đổi số sao trong 7 ngày qua - #16
Danh sách tổng hợp các khóa học, sách, bài giảng video và tài liệu nghiên cứu về Trí tuệ nhân tạo (AI).
★ 16.306+44Thay đổi số sao trong 7 ngày qua - #17
Bản cài đặt bằng Python của Reinforcement Learning: An Introduction
★ 14.758+0Thay đổi số sao trong 7 ngày qua - #18
Bullet Physics SDK: phát hiện va chạm thời gian thực và mô phỏng đa vật lý cho VR, trò chơi, hiệu ứng hình ảnh, robot, học máy, v.v.
★ 14.711+7Thay đổi số sao trong 7 ngày qua - #19
Hướng dẫn học tăng cường bằng tiếng Trung (Sách Nấm 🍄), địa chỉ đọc trực tuyến: https://datawhalechina.github.io/easy-rl/
★ 14.600+8Thay đổi số sao trong 7 ngày qua - #20
Phiên bản PyTorch của Stable Baselines, các bản cài đặt đáng tin cậy của thuật toán học tăng cường.
★ 13.758+21Thay đổi số sao trong 7 ngày qua - #21
Đắm mình vào Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision và NLP thông qua các bài giảng thú vị này!
★ 12.939+3Thay đổi số sao trong 7 ngày qua - #22
Một API chuẩn cho môi trường học tăng cường đơn tác nhân, kèm theo các môi trường tham chiếu phổ biến và các tiện ích liên quan (trước đây là Gym)
★ 12.451+21Thay đổi số sao trong 7 ngày qua - #23
Nền tảng nhà phát triển AI. Sử dụng Weights & Biases để huấn luyện và tinh chỉnh mô hình, đồng thời quản lý mô hình từ giai đoạn thử nghiệm đến sản xuất.
★ 11.249+4Thay đổi số sao trong 7 ngày qua - #24
Notebook 📓 Jupyter mẫu minh họa cách xây dựng, huấn luyện và triển khai các mô hình học máy sử dụng 🧠 Amazon SageMaker.
★ 10.983+2Thay đổi số sao trong 7 ngày qua - #25
Agent Reinforcement Trainer: huấn luyện các agent nhiều bước cho các tác vụ thực tế bằng GRPO. Cung cấp đào tạo tại chỗ cho các agent của bạn. Học tăng cường (Reinforcement learning) cho Qwen3.6, GPT-OSS, Llama và nhiều mô hình khác!
★ 10.689+10Thay đổi số sao trong 7 ngày qua - #26
Triển khai tệp đơn chất lượng cao cho các thuật toán Deep Reinforcement Learning với các tính năng thân thiện với nghiên cứu (PPO, DQN, C51, DDPG, TD3, SAC, PPG)
★ 10.358+19Thay đổi số sao trong 7 ngày qua - #27
Một khung làm việc Agentic RL dễ sử dụng, có khả năng mở rộng và hiệu năng cao dựa trên Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
★ 9.969+9Thay đổi số sao trong 7 ngày qua - #28
Hướng dẫn học tăng cường đơn giản, tài liệu giảng dạy AI tiếng Trung của MoFan Python
★ 9.508-2Thay đổi số sao trong 7 ngày qua - #29★ 8.925+37Thay đổi số sao trong 7 ngày qua
- #30
Bộ sưu tập các ví dụ và hướng dẫn về học máy.
★ 8.917+1Thay đổi số sao trong 7 ngày qua