Lompat ke konten utama
buildradar
Sign in
Topik · reinforcement-learning

reinforcement-learning

Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.

305 repositori
  • awesome-mlss@awesome-mlss

    🤖 Panduan Machine Learning Summer School

    3.033+3Perubahan bintang dalam 7 hari terakhir
  • agents@tensorflow

    TF-Agents: Pustaka TensorFlow yang andal, dapat diskalakan, dan mudah digunakan untuk Contextual Bandits dan Reinforcement Learning.

    3.026+0Perubahan bintang dalam 7 hari terakhir
  • Makalah penelitian Deep Learning dan deep reinforcement learning beserta beberapa kodenya

    3.026+2Perubahan bintang dalam 7 hari terakhir
  • mjlab@mujocolab

    API Isaac Lab, ditenagai oleh MuJoCo-Warp, untuk riset pembelajaran penguatan (RL) dan robotika

    2.960+82Perubahan bintang dalam 7 hari terakhir
  • openarm@enactic

    Lengan humanoid sumber terbuka penuh untuk penelitian AI fisik dan penerapan di lingkungan yang kaya kontak.

    2.919+23Perubahan bintang dalam 7 hari terakhir
  • Kerangka kerja pelatihan untuk agen pembelajaran penguatan Stable Baselines3, termasuk optimasi hiperparameter dan agen yang telah dilatih sebelumnya.

    2.873+1Perubahan bintang dalam 7 hari terakhir
  • Papers-in-100-Lines-of-Code@MaximeVandegar

    Implementasi makalah dalam 100 baris kode.

    2.870+3Perubahan bintang dalam 7 hari terakhir
  • muzero-general@werner-duvaud

    MuZero

    2.865+2Perubahan bintang dalam 7 hari terakhir
  • easy-tensorflow@easy-tensorflow

    Tutorial sederhana dan komprehensif dalam TensorFlow

    2.841+0Perubahan bintang dalam 7 hari terakhir
  • YC-Killer@sahibzada-allahyar

    Pustaka agen AI tingkat perusahaan yang dirancang untuk mendemokratisasikan kecerdasan buatan dan menyediakan alternatif sumber terbuka gratis untuk startup Y Combinator yang dinilai terlalu tinggi.

    2.806+7Perubahan bintang dalam 7 hari terakhir
  • RAGEN@mll-lab-nu

    Kerangka kerja Agent RL untuk agen LLM: reinforcement learning multi-putaran dengan StarPO dan diagnostik reasoning-collapse

    2.786+6Perubahan bintang dalam 7 hari terakhir
  • mctx@google-deepmind

    Pencarian pohon Monte Carlo di JAX

    2.657+3Perubahan bintang dalam 7 hari terakhir
  • PPOxFamily@opendilab

    Kursus Tutorial DRL PPO x Family (Kursus publik tingkat pemula untuk kecerdasan pengambilan keputusan)

    2.616+2Perubahan bintang dalam 7 hari terakhir
  • Kumpulan makalah Deep Learning untuk Pencarian, Rekomendasi, dan Iklan industri. Fokus pada Embedding, Matching, Pre-Ranking, Ranking, Post Ranking, Relevansi, LLM, dan RL. Mohon sitasi makalah kami "Deep Learning to Rank in Industrial Search Engines, Recommender Systems, and Online Advertising - An Overview and New Perspectives" (TOIS 2026).

    2.589+0Perubahan bintang dalam 7 hari terakhir
  • robosuite@ARISE-Initiative

    robosuite: Kerangka kerja simulasi modular dan tolok ukur untuk pembelajaran robot.

    2.586+4Perubahan bintang dalam 7 hari terakhir
  • Tutorial/Survei/Panduan Awesome Reasoning LLM

    2.533+6Perubahan bintang dalam 7 hari terakhir
  • Solusi untuk Reinforcement Learning, An Introduction.

    2.433+3Perubahan bintang dalam 7 hari terakhir
  • RL4LMs@allenai

    Pustaka RL modular untuk menyempurnakan model bahasa sesuai preferensi manusia.

    2.395+1Perubahan bintang dalam 7 hari terakhir
  • gym-anytrading@AminHP

    Lingkungan trading OpenAI Gym yang paling sederhana, fleksibel, dan komprehensif (Disetujui oleh OpenAI Gym)

    2.387+0Perubahan bintang dalam 7 hari terakhir
  • PPO-PyTorch@nikhilbarhate99

    Implementasi minimal dari clipped objective Proximal Policy Optimization (PPO) di PyTorch

    2.381+6Perubahan bintang dalam 7 hari terakhir
  • ProtoMotions@NVlabs

    ProtoMotions adalah kerangka simulasi dan pembelajaran yang dipercepat GPU untuk melatih manusia digital dan robot humanoid yang disimulasikan secara fisik.

    2.359+10Perubahan bintang dalam 7 hari terakhir
  • ICCV2019 - Belajar Melukis dengan Deep Reinforcement Learning berbasis Model

    2.308+2Perubahan bintang dalam 7 hari terakhir
  • drl-zh@alessiodm

    Deep Reinforcement Learning: Zero to Hero!

    2.293+0Perubahan bintang dalam 7 hari terakhir
  • MimicKit@xbpeng

    Kumpulan metode imitasi gerak yang ringan untuk melatih pengendali.

    2.280+15Perubahan bintang dalam 7 hari terakhir
  • verl-agent@langfengQ

    verl-agent adalah ekstensi dari veRL, yang dirancang untuk melatih agen LLM/VLM melalui RL. verl-agent juga merupakan kode resmi untuk makalah "Group-in-Group Policy Optimization for LLM Agent Training"

    2.274+17Perubahan bintang dalam 7 hari terakhir
  • RecSysPapers@tangxyw

    Koleksi makalah klasik industri dan mutakhir di bidang rekomendasi/periklanan/pencarian.

    2.188-1Perubahan bintang dalam 7 hari terakhir
  • gym-pybullet-drones@learnsyslab

    Lingkungan PyBullet Gymnasium untuk reinforcement learning agen tunggal dan multi-agen pada kontrol quadcopter

    2.119-2Perubahan bintang dalam 7 hari terakhir
  • ASAP@LeCAR-Lab

    [RSS 2025] "ASAP: Menyelaraskan Simulasi dan Fisika Dunia Nyata untuk Mempelajari Keterampilan Seluruh Tubuh Humanoid yang Gesit"

    2.107+3Perubahan bintang dalam 7 hari terakhir
  • diamond@eloialonso

    DIAMOND adalah agen pembelajaran penguatan (reinforcement learning) yang dilatih dalam model dunia difusi. NeurIPS 2024 Spotlight.

    2.100+1Perubahan bintang dalam 7 hari terakhir
  • ViZDoom@Farama-Foundation

    Lingkungan Reinforcement Learning berbasis game Doom tahun 1993.

    2.065+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik