reinforcement-learning
Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.
- #241
Lingkungan Gymnasium multi-tujuan untuk pembelajaran penguatan (reinforcement learning)
★ 760-1Perubahan bintang dalam 7 hari terakhir - #242★ 749—Perubahan bintang dalam 7 hari terakhir
- #243★ 737+2Perubahan bintang dalam 7 hari terakhir
- #244
Paket Contrib untuk Stable-Baselines3 - Kode reinforcement learning (RL) eksperimental
★ 736+5Perubahan bintang dalam 7 hari terakhir - #245★ 730+1Perubahan bintang dalam 7 hari terakhir
- #246
Ini adalah proyek tentang algoritma penghindaran rintangan otonom deep reinforcement learning untuk UAV.
★ 730+0Perubahan bintang dalam 7 hari terakhir - #247
Kode pendukung untuk publikasi Nature "Discovering State-of-the-art Reinforcement Algorithms"
★ 728+2Perubahan bintang dalam 7 hari terakhir - #248★ 726-1Perubahan bintang dalam 7 hari terakhir
- #249
Daftar kurasi sumber daya exploration RL yang luar biasa (diperbarui secara berkala)
★ 723+0Perubahan bintang dalam 7 hari terakhir - #250
Lingkungan poker OpenAI Gym untuk Texas Hold'em dengan reinforcement learning berbasis keras-rl. Termasuk rendering virtual dan montecarlo untuk perhitungan ekuitas.
★ 722+1Perubahan bintang dalam 7 hari terakhir - #251
Mesin poker untuk pengembangan AI poker dengan Python.
★ 722+1Perubahan bintang dalam 7 hari terakhir - #252
Kode untuk makalah "Optimalisasi Offloading Komputasi untuk Mobile Edge Computing yang dibantu UAV: Pendekatan Deep Deterministic Policy Gradient"
★ 722+1Perubahan bintang dalam 7 hari terakhir - #253
[COLM’25] DeepRetrieval — 🔥 Melatih Agen Pencarian melalui RLVR dengan Hasil Pengambilan.
★ 719+2Perubahan bintang dalam 7 hari terakhir - #254
Daftar kurasi makalah Monte Carlo tree search beserta implementasinya.
★ 715+1Perubahan bintang dalam 7 hari terakhir - #255
Platform Riset AI untuk Reinforcement Learning dari Citra Panoramik Nyata.
★ 713+1Perubahan bintang dalam 7 hari terakhir - #256
Reinforcement Learning dengan Model Predictive Control
★ 710+1Perubahan bintang dalam 7 hari terakhir - #257
Algoritma MARL yang telah disesuaikan pada SMAC (tingkat kemenangan 100% pada sebagian besar skenario)
★ 708-1Perubahan bintang dalam 7 hari terakhir - #258
Koleksi Frontend dan survei makalah vision-language model serta repositori GitHub model. Pembaruan berkelanjutan.
★ 706+3Perubahan bintang dalam 7 hari terakhir - #259★ 693+2Perubahan bintang dalam 7 hari terakhir
- #260
Kerangka kerja terpadu untuk reinforcement learning yang mudah pada model Flow-Matching
★ 692+7Perubahan bintang dalam 7 hari terakhir - #261
Implementasi algoritma Inverse Reinforcement Learning (IRL) dalam Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL
★ 681+2Perubahan bintang dalam 7 hari terakhir - #262
Simulator Hearthstone menggunakan C++ dengan beberapa reinforcement learning
★ 680+1Perubahan bintang dalam 7 hari terakhir - #263
Framework C++ untuk MDP dan POMDP dengan binding Python
★ 671+1Perubahan bintang dalam 7 hari terakhir - #264
Pustaka PyTorch untuk membangun agen deep reinforcement learning.
★ 657+0Perubahan bintang dalam 7 hari terakhir - #265
BenchMARL adalah pustaka untuk pengujian <i>benchmark</i> Multi-Agent Reinforcement Learning (MARL). BenchMARL memungkinkan perbandingan cepat antara berbagai algoritma, tugas, dan model MARL dengan tetap berlandaskan pada dua prinsip inti: reproduksibilitas dan standarisasi.
★ 656+2Perubahan bintang dalam 7 hari terakhir - #266
Siklus Hidup Lengkap Proyek Ilmu Data
★ 653+0Perubahan bintang dalam 7 hari terakhir - #267
Paket reinforcement learning untuk Julia
★ 652-1Perubahan bintang dalam 7 hari terakhir - #268
Kemajuan Terbaru dalam Penalaran Rantai Pemikiran Panjang
★ 647-1Perubahan bintang dalam 7 hari terakhir - #269★ 644+3Perubahan bintang dalam 7 hari terakhir
- #270
Halaman Proyek untuk "Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement"
★ 639+0Perubahan bintang dalam 7 hari terakhir