rl
Dépôts open source suivis étiquetés rl, triés par étoiles.
- #31
MobileGym : une plateforme de simulation vérifiable et hautement parallèle pour la recherche sur les agents d'interface graphique mobile, simulateur Android hébergé dans le navigateur, évaluation vérifiable, entraînement RL en ligne évolutif.
★ 786+10Évolution des étoiles sur les 7 derniers jours - #32
Package de contribution pour Stable-Baselines3 - Code expérimental d'apprentissage par renforcement (RL)
★ 736+5Évolution des étoiles sur les 7 derniers jours - #33
Une liste organisée d'articles sur la recherche arborescente de Monte Carlo avec implémentations.
★ 715+1Évolution des étoiles sur les 7 derniers jours - #34
Plateforme de recherche en IA pour l'apprentissage par renforcement à partir d'images panoramiques réelles.
★ 713+1Évolution des étoiles sur les 7 derniers jours - #35
Dépôt officiel de DR Tulu : Apprentissage par renforcement avec rubriques évolutives pour la recherche approfondie
★ 704+4Évolution des étoiles sur les 7 derniers jours - #36
Implémentation d'algorithmes d'apprentissage par renforcement inverse (IRL) en Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL
★ 681+2Évolution des étoiles sur les 7 derniers jours - #37
Simulateur Hearthstone utilisant C++ avec un certain apprentissage par renforcement
★ 680+1Évolution des étoiles sur les 7 derniers jours - #38
BenchMARL est une bibliothèque de benchmarking pour l'apprentissage par renforcement multi-agents (MARL). BenchMARL permet de comparer rapidement différents algorithmes MARL, tâches et modèles, tout en étant systématiquement fondé sur ses deux principes fondamentaux : la reproductibilité et la standardisation.
★ 656+2Évolution des étoiles sur les 7 derniers jours - #39
Dernières avancées sur le raisonnement à longue chaîne de pensée (Long Chain-of-Thought)
★ 647-1Évolution des étoiles sur les 7 derniers jours - #40
[NeurIPS 2022] 🛒WebShop : Vers une interaction Web réelle et évolutive avec des agents linguistiques ancrés
★ 589+3Évolution des étoiles sur les 7 derniers jours - #41
Implémentations de ROS2-Control pour robots quadrupèdes, incluant sim2real
★ 567+3Évolution des étoiles sur les 7 derniers jours - #42
Meta Agents Research Environments est une plateforme complète conçue pour évaluer les agents IA dans des scénarios dynamiques et réalistes. Contrairement aux benchmarks statiques, cette plateforme introduit des environnements évolutifs où les agents doivent adapter leurs stratégies à mesure que de nouvelles informations deviennent disponibles, reflétant les défis du monde réel.
★ 551+3Évolution des étoiles sur les 7 derniers jours - #43
Implémentations d'algorithmes d'apprentissage par renforcement multi-objectifs.
★ 533+1Évolution des étoiles sur les 7 derniers jours - #44
DeepThinkVLA : Amélioration de la capacité de raisonnement des modèles Vision-Langage-Action.
★ 529+0Évolution des étoiles sur les 7 derniers jours - #45★ 506+1Évolution des étoiles sur les 7 derniers jours
- #46
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—Évolution des étoiles sur les 7 derniers jours