Lompat ke konten utama
buildradar
Sign in
Topik · reinforcement-learning

reinforcement-learning

Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.

305 repositori
  • Algoritma Asynchronous Advantage Actor-Critic (A3C) untuk Super Mario Bros

    1.111-1Perubahan bintang dalam 7 hari terakhir
  • purejaxrl@luchris429

    Implementasi Jax RL End-to-End yang Sangat Cepat

    1.103+3Perubahan bintang dalam 7 hari terakhir
  • skrl@Toni-SM

    Pustaka Reinforcement Learning (RL) modular (diimplementasikan dalam PyTorch, JAX, dan NVIDIA Warp) dengan dukungan untuk Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground, dan lingkungan lainnya

    1.095+2Perubahan bintang dalam 7 hari terakhir
  • DexterousHands@PKU-MARL

    Pustaka yang menyediakan tugas manipulasi tangan tangkas ganda melalui Isaac Gym

    1.094+7Perubahan bintang dalam 7 hari terakhir
  • xuance@agi-brain

    XuanCe: Pustaka Deep Reinforcement Learning yang Komprehensif dan Terpadu

    1.086+4Perubahan bintang dalam 7 hari terakhir
  • Indeks algoritma untuk pembelajaran penguatan luring (offline-rl).

    1.078+3Perubahan bintang dalam 7 hari terakhir
  • Stable-Retro@Farama-Foundation

    Sebuah fork dari gym-retro dengan tambahan game, emulator, dan platform yang didukung

    1.077+395Perubahan bintang dalam 7 hari terakhir
  • sumo-rl@LucasAlegre

    Lingkungan Reinforcement Learning untuk Kontrol Lampu Lalu Lintas dengan SUMO. Kompatibel dengan Gymnasium, PettingZoo, dan pustaka RL populer.

    1.075+4Perubahan bintang dalam 7 hari terakhir
  • Books@Rishabh-creator601

    Buku / PDF / EPUB untuk berbagai bidang pemrograman. BACA, TUMBUH, DAN NIKMATI 😊😊😊😊

    1.066+6Perubahan bintang dalam 7 hari terakhir
  • Panduan Esensial untuk mengikuti perkembangan AI/ML/DL/CV

    1.063+0Perubahan bintang dalam 7 hari terakhir
  • judgeval@JudgmentLabs

    Stack Peningkatan Berkelanjutan untuk Agen. Data lingkungan dan evaluasi kami mendukung peningkatan dan pemantauan agen.

    1.060+2Perubahan bintang dalam 7 hari terakhir
  • Online-3D-BPP-PCT@alexfrom0815

    Implementasi kode dari "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Kami mengusulkan untuk meningkatkan penerapan praktis dari Masalah Pengepakan Kotak 3D Online (BPP) melalui pembelajaran pada pohon konfigurasi pengepakan hierarkis yang membuat model deep reinforcement learning (DRL) mudah menangani batasan praktis dan berkinerja baik bahkan dengan ruang solusi kontinu.

    1.047+1Perubahan bintang dalam 7 hari terakhir
  • Jalur pembelajaran terlengkap untuk insinyur agen · Kuasai AI Engineering dari nol · 20 tahap, 503 pelajaran · Terjemahan bahasa Mandarin lengkap + situs pendukung + video penjelasan animasi · Panduan menjadi insinyur AI Agent.

    1.047+39Perubahan bintang dalam 7 hari terakhir
  • GPTSwarm@metauto-ai

    🐝 Agen Self-Improving pertama dengan RL / Optimisasi Prompting

    1.043+3Perubahan bintang dalam 7 hari terakhir
  • rl-tools@rl-tools

    Library Deep Reinforcement Learning Tercepat

    1.033+3Perubahan bintang dalam 7 hari terakhir
  • rl-book@ZhiqingXiao

    Kode sumber untuk buku "Reinforcement Learning: Theory and Python Implementation"

    1.033+3Perubahan bintang dalam 7 hari terakhir
  • rl-mpc-locomotion@silvery107

    Deep RL untuk kontrol MPC pada Lokomosi Robot Berkaki Empat (Quadruped)

    1.024+4Perubahan bintang dalam 7 hari terakhir
  • sample-factory@alex-petrenko

    Reinforcement learning sinkron dan asinkron dengan throughput tinggi

    1.022+0Perubahan bintang dalam 7 hari terakhir
  • DeepRec@imsheridan

    Koleksi makalah dan materi klasik serta mutakhir industri rekomendasi dan periklanan / Must-read Papers on Recommendation System and CTR Prediction

    1.016+0Perubahan bintang dalam 7 hari terakhir
  • overcooked_ai@HumanCompatibleAI

    Lingkungan tolok ukur untuk kinerja manusia-AI yang sepenuhnya kooperatif.

    1.003+5Perubahan bintang dalam 7 hari terakhir
  • verl-omni@verl-project

    Kerangka kerja pelatihan RL multimodal untuk model diffusion & omni

    983+73Perubahan bintang dalam 7 hari terakhir
  • Materi Game AI Luar Biasa dari Multi-Agent Reinforcement Learning

    980+2Perubahan bintang dalam 7 hari terakhir
  • Step-Audio-EditX@stepfun-ai

    Model pengeditan audio Reinforcement Learning berbasis LLM dengan 3B parameter yang kuat, unggul dalam mengedit emosi, gaya bicara, dan paralinguistik, serta dilengkapi teks-ke-suara zero-shot yang tangguh

    973+2Perubahan bintang dalam 7 hari terakhir
  • Gymnasium-Robotics@Farama-Foundation

    Kumpulan lingkungan simulasi robotika untuk reinforcement learning

    963+1Perubahan bintang dalam 7 hari terakhir
  • Universitas Open Source Machine Learning

    955+0Perubahan bintang dalam 7 hari terakhir
  • Daftar Desain Molekuler dan Material menggunakan Generative AI dan Deep Learning

    952+1Perubahan bintang dalam 7 hari terakhir
  • AgileRL@AgileRL

    Menyederhanakan reinforcement learning dengan RLOps. Algoritma dan alat RL mutakhir, dengan pelatihan 10x lebih cepat melalui optimasi hyperparameter evolusioner.

    951+5Perubahan bintang dalam 7 hari terakhir
  • GibsonEnv@StanfordVL

    Gibson Environments: Persepsi Dunia Nyata untuk Agen Berwujud

    947+1Perubahan bintang dalam 7 hari terakhir
  • tdmpc2@nicklashansen

    Kode untuk "TD-MPC2: Model Dunia yang Dapat Skala dan Tangguh untuk Kontrol Kontinu"

    946+7Perubahan bintang dalam 7 hari terakhir
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    945Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik