Aller au contenu principal
buildradar
Sign in
Sujet · rl

rl

Dépôts open source suivis étiquetés rl, triés par étoiles.

46 dépôts
  • mobilegym@Purewhiter

    MobileGym : une plateforme de simulation vérifiable et hautement parallèle pour la recherche sur les agents d'interface graphique mobile, simulateur Android hébergé dans le navigateur, évaluation vérifiable, entraînement RL en ligne évolutif.

    786+10Évolution des étoiles sur les 7 derniers jours
  • stable-baselines3-contrib@Stable-Baselines-Team

    Package de contribution pour Stable-Baselines3 - Code expérimental d'apprentissage par renforcement (RL)

    736+5Évolution des étoiles sur les 7 derniers jours
  • Une liste organisée d'articles sur la recherche arborescente de Monte Carlo avec implémentations.

    715+1Évolution des étoiles sur les 7 derniers jours
  • Matterport3DSimulator@peteanderson80

    Plateforme de recherche en IA pour l'apprentissage par renforcement à partir d'images panoramiques réelles.

    713+1Évolution des étoiles sur les 7 derniers jours
  • dr-tulu@rlresearch

    Dépôt officiel de DR Tulu : Apprentissage par renforcement avec rubriques évolutives pour la recherche approfondie

    704+4Évolution des étoiles sur les 7 derniers jours
  • irl-imitation@yrlu

    Implémentation d'algorithmes d'apprentissage par renforcement inverse (IRL) en Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL

    681+2Évolution des étoiles sur les 7 derniers jours
  • RosettaStone@utilForever

    Simulateur Hearthstone utilisant C++ avec un certain apprentissage par renforcement

    680+1Évolution des étoiles sur les 7 derniers jours
  • BenchMARL@facebookresearch

    BenchMARL est une bibliothèque de benchmarking pour l'apprentissage par renforcement multi-agents (MARL). BenchMARL permet de comparer rapidement différents algorithmes MARL, tâches et modèles, tout en étant systématiquement fondé sur ses deux principes fondamentaux : la reproductibilité et la standardisation.

    656+2Évolution des étoiles sur les 7 derniers jours
  • Dernières avancées sur le raisonnement à longue chaîne de pensée (Long Chain-of-Thought)

    647-1Évolution des étoiles sur les 7 derniers jours
  • WebShop@princeton-nlp

    [NeurIPS 2022] 🛒WebShop : Vers une interaction Web réelle et évolutive avec des agents linguistiques ancrés

    589+3Évolution des étoiles sur les 7 derniers jours
  • Implémentations de ROS2-Control pour robots quadrupèdes, incluant sim2real

    567+3Évolution des étoiles sur les 7 derniers jours
  • Meta Agents Research Environments est une plateforme complète conçue pour évaluer les agents IA dans des scénarios dynamiques et réalistes. Contrairement aux benchmarks statiques, cette plateforme introduit des environnements évolutifs où les agents doivent adapter leurs stratégies à mesure que de nouvelles informations deviennent disponibles, reflétant les défis du monde réel.

    551+3Évolution des étoiles sur les 7 derniers jours
  • morl-baselines@LucasAlegre

    Implémentations d'algorithmes d'apprentissage par renforcement multi-objectifs.

    533+1Évolution des étoiles sur les 7 derniers jours
  • DeepThinkVLA@OpenBMB

    DeepThinkVLA : Amélioration de la capacité de raisonnement des modèles Vision-Langage-Action.

    529+0Évolution des étoiles sur les 7 derniers jours
  • gem@axon-rl

    Un environnement d'entraînement (Gym) pour les LLM agents

    506+1Évolution des étoiles sur les 7 derniers jours
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets