reinforcement-learning
Dépôts open source suivis étiquetés reinforcement-learning, triés par étoiles.
- #211
Bibliothèque Python pour l'apprentissage par renforcement.
★ 944+0Évolution des étoiles sur les 7 derniers jours - #212
UniRL est un framework pour l'apprentissage par renforcement de modèles multimodaux unifiés.
★ 939+15Évolution des étoiles sur les 7 derniers jours - #213
Une base de code adaptée à la recherche pour l'expérimentation rapide de l'apprentissage par renforcement multi-agents dans JAX.
★ 934+1Évolution des étoiles sur les 7 derniers jours - #214
UniLab : une architecture hétérogène pour l'apprentissage par renforcement robotique au-delà des paradigmes dominés par les GPU
★ 926+18Évolution des étoiles sur les 7 derniers jours - #215
La plateforme Multi-Agent Resource Optimization (MARO) est une instance de Reinforcement Learning as a Service (RaaS) pour les problèmes d'optimisation des ressources dans le monde réel.
★ 923+1Évolution des étoiles sur les 7 derniers jours - #216
Résumé des articles et blogs clés sur les modèles de diffusion pour apprendre le sujet. Liste détaillée de toutes les publications sur la robotique par diffusion.
★ 920+0Évolution des étoiles sur les 7 derniers jours - #217
Environnements PyBullet CartPole et Quadrotor, avec dynamique symbolique a priori CasADi, pour le contrôle basé sur l'apprentissage et l'apprentissage par renforcement (RL).
★ 917+4Évolution des étoiles sur les 7 derniers jours - #218
Une liste organisée de ressources sur les Decision Transformers (mise à jour en continu).
★ 917+1Évolution des étoiles sur les 7 derniers jours - #219
Ressources CARLA incluant tutoriels, blog, code, etc. https://github.com/carla-simulator/carla
★ 915-1Évolution des étoiles sur les 7 derniers jours - #220★ 905+0Évolution des étoiles sur les 7 derniers jours
- #221
Une liste organisée de ressources sur l'apprentissage par renforcement profond (Deep Reinforcement Learning).
★ 900+0Évolution des étoiles sur les 7 derniers jours - #222
Une bibliothèque PyTorch dédiée à l'apprentissage par renforcement (RL) pour l'optimisation combinatoire (CO)
★ 900+0Évolution des étoiles sur les 7 derniers jours - #223
Les Transformers sont des modèles de monde efficaces en termes d'échantillonnage. ICLR 2023, parmi les 5 % meilleurs.
★ 899-1Évolution des étoiles sur les 7 derniers jours - #224★ 897+757Évolution des étoiles sur les 7 derniers jours
- #225
Tien Kung-Lab : Workflow IsaacLab direct pour robots à pattes
★ 884+6Évolution des étoiles sur les 7 derniers jours - #226
🕹️ Une suite diversifiée d'environnements d'apprentissage par renforcement évolutifs sous JAX.
★ 861+1Évolution des étoiles sur les 7 derniers jours - #227
Outil de conception moléculaire par IA pour le design de novo, le scaffold hopping, le remplacement de groupes R, le design de linkers et l'optimisation de molécules
★ 854+2Évolution des étoiles sur les 7 derniers jours - #228★ 849-1Évolution des étoiles sur les 7 derniers jours
- #229★ 848+1Évolution des étoiles sur les 7 derniers jours
- #230★ 841+0Évolution des étoiles sur les 7 derniers jours
- #231
Une collection organisée d'outils d'IA, d'API, de jeux de données et de ressources d'apprentissage de haute qualité couvrant le machine learning, le deep learning, l'IA générative, le NLP et la science des données. Conçu pour aider les développeurs, les chercheurs et les créateurs à explorer et à construire avec l'IA plus rapidement.
★ 841+12Évolution des étoiles sur les 7 derniers jours - #232
Implémentations en Python d'algorithmes de bandits contextuels.
★ 839+2Évolution des étoiles sur les 7 derniers jours - #233
Ce dépôt contient des bases de référence pour l'apprentissage par renforcement sécurisé.
★ 814+1Évolution des étoiles sur les 7 derniers jours - #234
Collection de projets publics remarquables sur les LLM, VLM, VLA, AIGC, ainsi que les jeux de données et applications associés.
★ 813-1Évolution des étoiles sur les 7 derniers jours - #235
Collection organisée d'articles, de rapports techniques, de frameworks et d'outils pour la distillation on-policy (OPD) des grands modèles de langage
★ 803+32Évolution des étoiles sur les 7 derniers jours - #236
Une liste organisée de frameworks, articles, logiciels et ressources exceptionnels pour NVIDIA Isaac Gym.
★ 797+1Évolution des étoiles sur les 7 derniers jours - #237
MobileGym : une plateforme de simulation vérifiable et hautement parallèle pour la recherche sur les agents d'interface graphique mobile, simulateur Android hébergé dans le navigateur, évaluation vérifiable, entraînement RL en ligne évolutif.
★ 787+5Évolution des étoiles sur les 7 derniers jours - #238
BFM_Zero : un modèle de fondation comportemental pilotable pour le contrôle d'humanoïdes utilisant l'apprentissage par renforcement non supervisé
★ 779+5Évolution des étoiles sur les 7 derniers jours - #239
MDP et POMDP en Julia : une interface pour définir, résoudre et simuler des processus de décision markoviens totalement ou partiellement observables sur des espaces discrets et continus.
★ 767+2Évolution des étoiles sur les 7 derniers jours - #240
Ensemble d'environnements robotiques basés sur le moteur physique PyBullet et gymnasium.
★ 766+1Évolution des étoiles sur les 7 derniers jours