reinforcement-learning
Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.
- #181
Algoritma Asynchronous Advantage Actor-Critic (A3C) untuk Super Mario Bros
★ 1.111-1Perubahan bintang dalam 7 hari terakhir - #182★ 1.103+3Perubahan bintang dalam 7 hari terakhir
- #183
Pustaka Reinforcement Learning (RL) modular (diimplementasikan dalam PyTorch, JAX, dan NVIDIA Warp) dengan dukungan untuk Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground, dan lingkungan lainnya
★ 1.095+2Perubahan bintang dalam 7 hari terakhir - #184
Pustaka yang menyediakan tugas manipulasi tangan tangkas ganda melalui Isaac Gym
★ 1.094+7Perubahan bintang dalam 7 hari terakhir - #185★ 1.086+4Perubahan bintang dalam 7 hari terakhir
- #186
Indeks algoritma untuk pembelajaran penguatan luring (offline-rl).
★ 1.078+3Perubahan bintang dalam 7 hari terakhir - #187
Sebuah fork dari gym-retro dengan tambahan game, emulator, dan platform yang didukung
★ 1.077+395Perubahan bintang dalam 7 hari terakhir - #188
Lingkungan Reinforcement Learning untuk Kontrol Lampu Lalu Lintas dengan SUMO. Kompatibel dengan Gymnasium, PettingZoo, dan pustaka RL populer.
★ 1.075+4Perubahan bintang dalam 7 hari terakhir - #189
Buku / PDF / EPUB untuk berbagai bidang pemrograman. BACA, TUMBUH, DAN NIKMATI 😊😊😊😊
★ 1.066+6Perubahan bintang dalam 7 hari terakhir - #190
Panduan Esensial untuk mengikuti perkembangan AI/ML/DL/CV
★ 1.063+0Perubahan bintang dalam 7 hari terakhir - #191
Stack Peningkatan Berkelanjutan untuk Agen. Data lingkungan dan evaluasi kami mendukung peningkatan dan pemantauan agen.
★ 1.060+2Perubahan bintang dalam 7 hari terakhir - #192
Implementasi kode dari "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Kami mengusulkan untuk meningkatkan penerapan praktis dari Masalah Pengepakan Kotak 3D Online (BPP) melalui pembelajaran pada pohon konfigurasi pengepakan hierarkis yang membuat model deep reinforcement learning (DRL) mudah menangani batasan praktis dan berkinerja baik bahkan dengan ruang solusi kontinu.
★ 1.047+1Perubahan bintang dalam 7 hari terakhir - #193
Jalur pembelajaran terlengkap untuk insinyur agen · Kuasai AI Engineering dari nol · 20 tahap, 503 pelajaran · Terjemahan bahasa Mandarin lengkap + situs pendukung + video penjelasan animasi · Panduan menjadi insinyur AI Agent.
★ 1.047+39Perubahan bintang dalam 7 hari terakhir - #194★ 1.043+3Perubahan bintang dalam 7 hari terakhir
- #195★ 1.033+3Perubahan bintang dalam 7 hari terakhir
- #196
Kode sumber untuk buku "Reinforcement Learning: Theory and Python Implementation"
★ 1.033+3Perubahan bintang dalam 7 hari terakhir - #197
Deep RL untuk kontrol MPC pada Lokomosi Robot Berkaki Empat (Quadruped)
★ 1.024+4Perubahan bintang dalam 7 hari terakhir - #198
Reinforcement learning sinkron dan asinkron dengan throughput tinggi
★ 1.022+0Perubahan bintang dalam 7 hari terakhir - #199
Koleksi makalah dan materi klasik serta mutakhir industri rekomendasi dan periklanan / Must-read Papers on Recommendation System and CTR Prediction
★ 1.016+0Perubahan bintang dalam 7 hari terakhir - #200
Lingkungan tolok ukur untuk kinerja manusia-AI yang sepenuhnya kooperatif.
★ 1.003+5Perubahan bintang dalam 7 hari terakhir - #201★ 983+73Perubahan bintang dalam 7 hari terakhir
- #202
Materi Game AI Luar Biasa dari Multi-Agent Reinforcement Learning
★ 980+2Perubahan bintang dalam 7 hari terakhir - #203
Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh
★ 973+2Perubahan bintang dalam 7 hari terakhir - #204
Kumpulan lingkungan simulasi robotika untuk reinforcement learning
★ 963+1Perubahan bintang dalam 7 hari terakhir - #205
Universitas Open Source Machine Learning
★ 955+0Perubahan bintang dalam 7 hari terakhir - #206
Daftar Desain Molekuler dan Material menggunakan Generative AI dan Deep Learning
★ 952+1Perubahan bintang dalam 7 hari terakhir - #207
Menyederhanakan reinforcement learning dengan RLOps. Algoritma dan alat RL mutakhir, dengan pelatihan 10x lebih cepat melalui optimasi hyperparameter evolusioner.
★ 951+5Perubahan bintang dalam 7 hari terakhir - #208★ 947+1Perubahan bintang dalam 7 hari terakhir
- #209
Kode untuk "TD-MPC2: Model Dunia yang Dapat Skala dan Tangguh untuk Kontrol Kontinu"
★ 946+7Perubahan bintang dalam 7 hari terakhir - #210
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 945—Perubahan bintang dalam 7 hari terakhir