Lompat ke konten utama
buildradar
Sign in
Topik · reinforcement-learning-algorithms

reinforcement-learning-algorithms

Repositori open source terpantau bertanda reinforcement-learning-algorithms, diurutkan berdasarkan bintang.

Repositori
21
Total bintang
39.604
Rata-rata bintang
1.886
Porsi
0,00%

Topik yang sering muncul berdampingan dengan reinforcement-learning-algorithms di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda reinforcement-learning-algorithms.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • Versi PyTorch dari Stable Baselines, implementasi algoritma reinforcement learning yang andal.

    13.758+21Perubahan bintang dalam 7 hari terakhir
  • deep-reinforcement-learning@udacity

    Repositori untuk program Nanodegree Deep Reinforcement Learning.

    5.176+0Perubahan bintang dalam 7 hari terakhir
  • DI-engine@opendilab

    Mesin AI Keputusan OpenDILab. Framework Reinforcement Learning Paling Komprehensif.

    3.642+1Perubahan bintang dalam 7 hari terakhir
  • PPO-PyTorch@nikhilbarhate99

    Implementasi minimal dari clipped objective Proximal Policy Optimization (PPO) di PyTorch

    2.381+6Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi sumber daya reinforcement learning berbasis model yang luar biasa (terus diperbarui)

    1.393+0Perubahan bintang dalam 7 hari terakhir
  • PPO-for-Beginners@ericyangyu

    Implementasi PPO yang sederhana dan bergaya baik. Berdasarkan seri Medium saya: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1.269+1Perubahan bintang dalam 7 hari terakhir
  • ARPO@RUC-NLPIR

    [ICLR 2026] Agentic Reinforced Policy Optimization (ARPO)

    1.116+5Perubahan bintang dalam 7 hari terakhir
  • purejaxrl@luchris429

    Implementasi Jax RL End-to-End yang Sangat Cepat

    1.103+2Perubahan bintang dalam 7 hari terakhir
  • UI-Venus@inclusionAI

    UI-Venus adalah agen UI native yang dirancang untuk melakukan grounding elemen GUI secara presisi dan navigasi yang efektif hanya menggunakan tangkapan layar sebagai masukan.

    1.037+23Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi sumber daya Decision Transformer (diperbarui terus-menerus)

    916+0Perubahan bintang dalam 7 hari terakhir
  • course-content-dl@NeuromatchAcademy

    Kursus deep learning NMA

    812+1Perubahan bintang dalam 7 hari terakhir
  • POMDPs.jl@JuliaPOMDP

    MDP dan POMDP di Julia - Antarmuka untuk mendefinisikan, menyelesaikan, dan mensimulasikan proses keputusan Markov yang dapat diamati sepenuhnya dan sebagian pada ruang diskrit dan kontinu.

    766+1Perubahan bintang dalam 7 hari terakhir
  • stable-baselines3-contrib@Stable-Baselines-Team

    Paket Contrib untuk Stable-Baselines3 - Kode reinforcement learning (RL) eksperimental

    736+5Perubahan bintang dalam 7 hari terakhir
  • Ini adalah proyek tentang algoritma penghindaran rintangan otonom deep reinforcement learning untuk UAV.

    730+0Perubahan bintang dalam 7 hari terakhir
  • disco_rl@google-deepmind

    Kode pendukung untuk publikasi Nature "Discovering State-of-the-art Reinforcement Algorithms"

    728+2Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi sumber daya exploration RL yang luar biasa (diperbarui secara berkala)

    723+0Perubahan bintang dalam 7 hari terakhir
  • UAV-DDPG@fangvv

    Kode untuk makalah "Optimalisasi Offloading Komputasi untuk Mobile Edge Computing yang dibantu UAV: Pendekatan Deep Deterministic Policy Gradient"

    722+1Perubahan bintang dalam 7 hari terakhir
  • Rofunc@Skylark0924

    🤖 Paket Python Proses Penuh untuk Pembelajaran Robot dari Demonstrasi dan Manipulasi Robot

    720+1Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah Monte Carlo tree search beserta implementasinya.

    715+1Perubahan bintang dalam 7 hari terakhir
  • Pustaka PyTorch untuk membangun agen deep reinforcement learning.

    657+0Perubahan bintang dalam 7 hari terakhir
  • dLLM-RL@Gen-Verse

    [ICLR 2026] Kode resmi untuk TraceRL: Revolusi pasca-pelatihan untuk Diffusion LLMs, yang mendukung seri SOTA TraDo.

    520+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik