reinforcement-learning
Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.
- #151
ReSearch: Belajar Bernalar dengan Pencarian untuk LLM melalui Reinforcement Learning & ReCall: Belajar Bernalar dengan Pemanggilan Alat untuk LLM melalui Reinforcement Learning
★ 1.432+1Perubahan bintang dalam 7 hari terakhir - #152
Algoritma yang ringkas dan indah yang ditulis dalam Julia
★ 1.426+0Perubahan bintang dalam 7 hari terakhir - #153
Daftar kurasi sumber daya reinforcement learning berbasis model yang luar biasa (terus diperbarui)
★ 1.393+0Perubahan bintang dalam 7 hari terakhir - #154★ 1.385+2Perubahan bintang dalam 7 hari terakhir
- #155
Kucing robot yang dapat diprogram dan sangat lincah untuk pendidikan STEM serta layanan yang ditingkatkan AI.
★ 1.372+1Perubahan bintang dalam 7 hari terakhir - #156★ 1.367+1Perubahan bintang dalam 7 hari terakhir
- #157
Deep Reinforcement Learning untuk navigasi robot seluler di simulator ROS Gazebo. Menggunakan jaringan saraf Twin Delayed Deep Deterministic Policy Gradient (TD3), robot belajar menavigasi ke titik tujuan acak di lingkungan simulasi sambil menghindari rintangan.
★ 1.362+2Perubahan bintang dalam 7 hari terakhir - #158
Kerangka kerja Deep Reinforcement Learning modular di PyTorch. Pustaka pendamping buku "Foundations of Deep Reinforcement Learning".
★ 1.362+0Perubahan bintang dalam 7 hari terakhir - #159
Implementasi PyTorch dari Soft Actor-Critic (SAC), Twin Delayed DDPG (TD3), Actor-Critic (AC/A2C), Proximal Policy Optimization (PPO), QT-Opt, PointNet..
★ 1.359+1Perubahan bintang dalam 7 hari terakhir - #160
Ekosistem aktif tempat agen AI menyelesaikan tugas melalui perulangan alur kerja, meningkatkan diri melalui eksekusi iteratif, dievaluasi oleh agen mentor atau manusia, dan mengubah pekerjaan selesai menjadi pengalaman kerja serta data yang dapat digunakan kembali untuk meningkatkan agen masa depan.
★ 1.334+0Perubahan bintang dalam 7 hari terakhir - #161
Implementasi Deep Q Learning (DQN & DDQN) minimal dalam Keras
★ 1.329+1Perubahan bintang dalam 7 hari terakhir - #162
Format standar untuk dataset reinforcement learning offline, dengan dataset referensi populer dan utilitas terkait
★ 1.294+3Perubahan bintang dalam 7 hari terakhir - #163
Catatan membaca makalah tentang Deep Learning dan Machine Learning
★ 1.270+0Perubahan bintang dalam 7 hari terakhir - #164
Implementasi PPO yang sederhana dan bergaya baik. Berdasarkan seri Medium saya: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.
★ 1.269+1Perubahan bintang dalam 7 hari terakhir - #165
Penelitian RL pada perangkat Android.
★ 1.240+0Perubahan bintang dalam 7 hari terakhir - #166
Menghasilkan kumpulan faktor saham alfa formulaik (prediktif) melalui reinforcement learning.
★ 1.213+8Perubahan bintang dalam 7 hari terakhir - #167
Melatih robot humanoid untuk lokomosi menggunakan Reinforcement Learning
★ 1.210+3Perubahan bintang dalam 7 hari terakhir - #168
Catatan kuliah, tugas tutorial beserta solusinya, serta video online untuk kursus reinforcement learning yang diselenggarakan oleh Paderborn University
★ 1.192+1Perubahan bintang dalam 7 hari terakhir - #169★ 1.188+0Perubahan bintang dalam 7 hari terakhir
- #170
[ECCV 2026] MixGRPO: Membuka Efisiensi GRPO Berbasis Aliran dengan Campuran ODE-SDE
★ 1.177+0Perubahan bintang dalam 7 hari terakhir - #171★ 1.155+7Perubahan bintang dalam 7 hari terakhir
- #172
Mengevaluasi dan mereproduksi kebijakan manipulasi robot dunia nyata (misalnya, RT-1, RT-1-X, Octo) dalam simulasi di bawah pengaturan umum (misalnya, Google Robot, WidowX+Bridge) (CoRL 2024)
★ 1.153+3Perubahan bintang dalam 7 hari terakhir - #173
JMLR: OmniSafe adalah kerangka kerja infrastruktur untuk mempercepat riset SafeRL.
★ 1.150+1Perubahan bintang dalam 7 hari terakhir - #174
Pustaka komputasi evolusioner tingkat lanjut yang dibangun langsung di atas PyTorch, dibuat di NNAISENSE.
★ 1.144+1Perubahan bintang dalam 7 hari terakhir - #175★ 1.134+0Perubahan bintang dalam 7 hari terakhir
- #176
:computer: Belajar membuat mesin belajar agar Anda tidak perlu kesulitan memrogramnya; Daftar utama
★ 1.128+0Perubahan bintang dalam 7 hari terakhir - #177
Simulator robot ringan berbasis Python yang dirancang untuk navigasi, kontrol, dan pembelajaran
★ 1.125+6Perubahan bintang dalam 7 hari terakhir - #178
Embedding keterampilan adversarial untuk melatih pengontrol yang dapat digunakan kembali pada karakter yang disimulasikan secara fisik.
★ 1.121+2Perubahan bintang dalam 7 hari terakhir - #179★ 1.116+5Perubahan bintang dalam 7 hari terakhir
- #180
Kami memperkenalkan dataset Audio Logical Reasoning (ALR), yang terdiri dari 6.446 sampel anotasi teks-audio yang dirancang khusus untuk tugas penalaran kompleks. Berdasarkan sumber daya ini, kami mengusulkan SoundMind, sebuah algoritma reinforcement learning (RL) berbasis aturan yang dirancang untuk membekali model bahasa audio (ALM) dengan kemampuan penalaran bimodal yang mendalam.
★ 1.113+0Perubahan bintang dalam 7 hari terakhir