reinforcement-learning
Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.
- #91
🤖 Panduan Machine Learning Summer School
★ 3.033+3Perubahan bintang dalam 7 hari terakhir - #92
TF-Agents: Pustaka TensorFlow yang andal, dapat diskalakan, dan mudah digunakan untuk Contextual Bandits dan Reinforcement Learning.
★ 3.026+0Perubahan bintang dalam 7 hari terakhir - #93
Makalah penelitian Deep Learning dan deep reinforcement learning beserta beberapa kodenya
★ 3.026+2Perubahan bintang dalam 7 hari terakhir - #94
API Isaac Lab, ditenagai oleh MuJoCo-Warp, untuk riset pembelajaran penguatan (RL) dan robotika
★ 2.960+82Perubahan bintang dalam 7 hari terakhir - #95
Lengan humanoid sumber terbuka penuh untuk penelitian AI fisik dan penerapan di lingkungan yang kaya kontak.
★ 2.919+23Perubahan bintang dalam 7 hari terakhir - #96
Kerangka kerja pelatihan untuk agen pembelajaran penguatan Stable Baselines3, termasuk optimasi hiperparameter dan agen yang telah dilatih sebelumnya.
★ 2.873+1Perubahan bintang dalam 7 hari terakhir - #97
Implementasi makalah dalam 100 baris kode.
★ 2.870+3Perubahan bintang dalam 7 hari terakhir - #98
MuZero
★ 2.865+2Perubahan bintang dalam 7 hari terakhir - #99
Tutorial sederhana dan komprehensif dalam TensorFlow
★ 2.841+0Perubahan bintang dalam 7 hari terakhir - #100
Pustaka agen AI tingkat perusahaan yang dirancang untuk mendemokratisasikan kecerdasan buatan dan menyediakan alternatif sumber terbuka gratis untuk startup Y Combinator yang dinilai terlalu tinggi.
★ 2.806+7Perubahan bintang dalam 7 hari terakhir - #101
Kerangka kerja Agent RL untuk agen LLM: reinforcement learning multi-putaran dengan StarPO dan diagnostik reasoning-collapse
★ 2.786+6Perubahan bintang dalam 7 hari terakhir - #102★ 2.657+3Perubahan bintang dalam 7 hari terakhir
- #103
Kursus Tutorial DRL PPO x Family (Kursus publik tingkat pemula untuk kecerdasan pengambilan keputusan)
★ 2.616+2Perubahan bintang dalam 7 hari terakhir - #104
Kumpulan makalah Deep Learning untuk Pencarian, Rekomendasi, dan Iklan industri. Fokus pada Embedding, Matching, Pre-Ranking, Ranking, Post Ranking, Relevansi, LLM, dan RL. Mohon sitasi makalah kami "Deep Learning to Rank in Industrial Search Engines, Recommender Systems, and Online Advertising - An Overview and New Perspectives" (TOIS 2026).
★ 2.589+0Perubahan bintang dalam 7 hari terakhir - #105
robosuite: Kerangka kerja simulasi modular dan tolok ukur untuk pembelajaran robot.
★ 2.586+4Perubahan bintang dalam 7 hari terakhir - #106
Tutorial/Survei/Panduan Awesome Reasoning LLM
★ 2.533+6Perubahan bintang dalam 7 hari terakhir - #107
Solusi untuk Reinforcement Learning, An Introduction.
★ 2.433+3Perubahan bintang dalam 7 hari terakhir - #108★ 2.395+1Perubahan bintang dalam 7 hari terakhir
- #109
Lingkungan trading OpenAI Gym yang paling sederhana, fleksibel, dan komprehensif (Disetujui oleh OpenAI Gym)
★ 2.387+0Perubahan bintang dalam 7 hari terakhir - #110
Implementasi minimal dari clipped objective Proximal Policy Optimization (PPO) di PyTorch
★ 2.381+6Perubahan bintang dalam 7 hari terakhir - #111
ProtoMotions adalah kerangka simulasi dan pembelajaran yang dipercepat GPU untuk melatih manusia digital dan robot humanoid yang disimulasikan secara fisik.
★ 2.359+10Perubahan bintang dalam 7 hari terakhir - #112
ICCV2019 - Belajar Melukis dengan Deep Reinforcement Learning berbasis Model
★ 2.308+2Perubahan bintang dalam 7 hari terakhir - #113★ 2.293+0Perubahan bintang dalam 7 hari terakhir
- #114★ 2.280+15Perubahan bintang dalam 7 hari terakhir
- #115
verl-agent adalah ekstensi dari veRL, yang dirancang untuk melatih agen LLM/VLM melalui RL. verl-agent juga merupakan kode resmi untuk makalah "Group-in-Group Policy Optimization for LLM Agent Training"
★ 2.274+17Perubahan bintang dalam 7 hari terakhir - #116
Koleksi makalah klasik industri dan mutakhir di bidang rekomendasi/periklanan/pencarian.
★ 2.188-1Perubahan bintang dalam 7 hari terakhir - #117
Lingkungan PyBullet Gymnasium untuk reinforcement learning agen tunggal dan multi-agen pada kontrol quadcopter
★ 2.119-2Perubahan bintang dalam 7 hari terakhir - #118
[RSS 2025] "ASAP: Menyelaraskan Simulasi dan Fisika Dunia Nyata untuk Mempelajari Keterampilan Seluruh Tubuh Humanoid yang Gesit"
★ 2.107+3Perubahan bintang dalam 7 hari terakhir - #119
DIAMOND adalah agen pembelajaran penguatan (reinforcement learning) yang dilatih dalam model dunia difusi. NeurIPS 2024 Spotlight.
★ 2.100+1Perubahan bintang dalam 7 hari terakhir - #120★ 2.065+0Perubahan bintang dalam 7 hari terakhir