Lompat ke konten utama
buildradar
Sign in
Topik · rl

rl

Repositori open source terpantau bertanda rl, diurutkan berdasarkan bintang.

46 repositori
  • mobilegym@Purewhiter

    MobileGym: Platform Simulasi yang Dapat Verifikasi dan Sangat Pararel untuk Penelitian Agen GUI Seluler · Simulator Android yang berjalan di browser · Simulator Android Berbasis Browser · Evaluasi yang Dapat Verifikasi · Pelatihan RL Online yang Dapat Skala

    786+10Perubahan bintang dalam 7 hari terakhir
  • stable-baselines3-contrib@Stable-Baselines-Team

    Paket Contrib untuk Stable-Baselines3 - Kode reinforcement learning (RL) eksperimental

    736+5Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah Monte Carlo tree search beserta implementasinya.

    715+1Perubahan bintang dalam 7 hari terakhir
  • Matterport3DSimulator@peteanderson80

    Platform Riset AI untuk Reinforcement Learning dari Citra Panoramik Nyata.

    713+1Perubahan bintang dalam 7 hari terakhir
  • dr-tulu@rlresearch

    Repositori resmi untuk DR Tulu: Reinforcement Learning dengan Evolving Rubrics untuk Deep Research

    704+4Perubahan bintang dalam 7 hari terakhir
  • irl-imitation@yrlu

    Implementasi algoritma Inverse Reinforcement Learning (IRL) dalam Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL

    681+2Perubahan bintang dalam 7 hari terakhir
  • RosettaStone@utilForever

    Simulator Hearthstone menggunakan C++ dengan beberapa reinforcement learning

    680+1Perubahan bintang dalam 7 hari terakhir
  • BenchMARL@facebookresearch

    BenchMARL adalah pustaka untuk pengujian <i>benchmark</i> Multi-Agent Reinforcement Learning (MARL). BenchMARL memungkinkan perbandingan cepat antara berbagai algoritma, tugas, dan model MARL dengan tetap berlandaskan pada dua prinsip inti: reproduksibilitas dan standarisasi.

    656+2Perubahan bintang dalam 7 hari terakhir
  • Kemajuan Terbaru dalam Penalaran Rantai Pemikiran Panjang

    647-1Perubahan bintang dalam 7 hari terakhir
  • WebShop@princeton-nlp

    [NeurIPS 2022] 🛒WebShop: Menuju Interaksi Web Dunia Nyata yang Skalabel dengan Agen Bahasa Berbasis Grounding

    589+3Perubahan bintang dalam 7 hari terakhir
  • Implementasi ROS2-Control untuk robot berkaki empat, termasuk sim2real

    567+3Perubahan bintang dalam 7 hari terakhir
  • Meta Agents Research Environments adalah platform komprehensif yang dirancang untuk mengevaluasi agen AI dalam skenario yang dinamis dan realistis. Tidak seperti tolok ukur statis, platform ini memperkenalkan lingkungan yang terus berkembang di mana agen harus menyesuaikan strategi mereka saat informasi baru tersedia, mencerminkan tantangan di dunia nyata.

    551+3Perubahan bintang dalam 7 hari terakhir
  • morl-baselines@LucasAlegre

    Implementasi algoritma Multi-Objective Reinforcement Learning.

    533+1Perubahan bintang dalam 7 hari terakhir
  • DeepThinkVLA@OpenBMB

    DeepThinkVLA: Meningkatkan Kemampuan Penalaran Model Vision-Language-Action

    529+0Perubahan bintang dalam 7 hari terakhir
  • gem@axon-rl

    Sebuah Gym untuk Agentic LLMs

    506+1Perubahan bintang dalam 7 hari terakhir
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik