reinforcement-learning
Dépôts open source suivis étiquetés reinforcement-learning, triés par étoiles.
- #181
Algorithme Asynchronous Advantage Actor-Critic (A3C) pour Super Mario Bros.
★ 1 111-1Évolution des étoiles sur les 7 derniers jours - #182★ 1 102+2Évolution des étoiles sur les 7 derniers jours
- #183
Bibliothèque modulaire d'apprentissage par renforcement (RL) (implémentée en PyTorch, JAX et NVIDIA Warp) avec prise en charge de Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground et d'autres environnements
★ 1 095+2Évolution des étoiles sur les 7 derniers jours - #184
Bibliothèque fournissant des tâches de manipulation à deux mains dextres via Isaac Gym
★ 1 093+6Évolution des étoiles sur les 7 derniers jours - #185
XuanCe : une bibliothèque d'apprentissage par renforcement profond complète et unifiée
★ 1 083+2Évolution des étoiles sur les 7 derniers jours - #186
Un fork de gym-retro avec des jeux supplémentaires, des émulateurs et des plateformes supportées
★ 1 079+396Évolution des étoiles sur les 7 derniers jours - #187
Index d'algorithmes pour l'apprentissage par renforcement hors ligne (offline-rl)
★ 1 078+3Évolution des étoiles sur les 7 derniers jours - #188
Environnements d'apprentissage par renforcement pour le contrôle des feux de signalisation avec SUMO. Compatible avec Gymnasium, PettingZoo et les bibliothèques RL populaires.
★ 1 074+3Évolution des étoiles sur les 7 derniers jours - #189★ 1 065+5Évolution des étoiles sur les 7 derniers jours
- #190
Guide essentiel pour rester à jour sur l'IA, le ML, le DL et la vision par ordinateur.
★ 1 063+0Évolution des étoiles sur les 7 derniers jours - #191
La stack d'amélioration continue pour les agents. Nos données d'environnement et nos évaluations alimentent l'amélioration et la surveillance des agents.
★ 1 060+2Évolution des étoiles sur les 7 derniers jours - #192
Implémentation du code pour "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Nous proposons d'améliorer l'applicabilité pratique du problème de Bin Packing 3D en ligne (BPP) via l'apprentissage sur un arbre de configuration d'emballage hiérarchique, ce qui permet au modèle d'apprentissage par renforcement profond (DRL) de gérer facilement les contraintes pratiques et d'être performant même avec un espace de solution continu.
★ 1 047+1Évolution des étoiles sur les 7 derniers jours - #193★ 1 041+1Évolution des étoiles sur les 7 derniers jours
- #194
Parcours d'apprentissage complet pour ingénieurs Agent : maîtriser l'ingénierie IA à partir de zéro, 20 étapes, 503 cours, traduction complète, site dédié et vidéos explicatives animées.
★ 1 041+38Évolution des étoiles sur les 7 derniers jours - #195★ 1 033+3Évolution des étoiles sur les 7 derniers jours
- #196★ 1 033+3Évolution des étoiles sur les 7 derniers jours
- #197
Apprentissage par renforcement synchrone et asynchrone à haut débit.
★ 1 022+1Évolution des étoiles sur les 7 derniers jours - #198
Apprentissage par renforcement profond pour le contrôle MPC de la locomotion de robots quadrupèdes
★ 1 022+2Évolution des étoiles sur les 7 derniers jours - #199
Collection d'articles et de documents classiques et de pointe sur les systèmes de recommandation et la prédiction CTR.
★ 1 016+0Évolution des étoiles sur les 7 derniers jours - #200
Un environnement de benchmark pour la performance en coopération totale entre humains et IA.
★ 1 003+5Évolution des étoiles sur les 7 derniers jours - #201
Ressources exceptionnelles sur l'IA de jeu pour l'apprentissage par renforcement multi-agents
★ 979+2Évolution des étoiles sur les 7 derniers jours - #202
Un puissant modèle d'édition audio basé sur l'apprentissage par renforcement et un LLM de 3 milliards de paramètres, spécialisé dans l'édition des émotions, du style de parole et des paralinguistiques, avec des capacités robustes de synthèse vocale zero-shot
★ 972+2Évolution des étoiles sur les 7 derniers jours - #203
Une collection d'environnements de simulation robotique pour l'apprentissage par renforcement
★ 963+1Évolution des étoiles sur les 7 derniers jours - #204★ 955+60Évolution des étoiles sur les 7 derniers jours
- #205
Université open source pour l'apprentissage automatique.
★ 955+0Évolution des étoiles sur les 7 derniers jours - #206
Liste de conceptions moléculaires et matérielles utilisant l'IA générative et l'apprentissage profond.
★ 952+1Évolution des étoiles sur les 7 derniers jours - #207
Optimisation de l'apprentissage par renforcement avec RLOps. Algorithmes et outils RL de pointe, avec un entraînement 10 fois plus rapide grâce à l'optimisation évolutionnaire des hyperparamètres.
★ 950+4Évolution des étoiles sur les 7 derniers jours - #208★ 947+1Évolution des étoiles sur les 7 derniers jours
- #209
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 947—Évolution des étoiles sur les 7 derniers jours - #210
Bibliothèque Python pour l'apprentissage par renforcement.
★ 944+0Évolution des étoiles sur les 7 derniers jours