opendilab
Dépôts open source suivis de opendilab, triés par étoiles.
- #1
Une liste organisée de ressources sur l'apprentissage par renforcement à partir de rétroaction humaine (mise à jour continue).
★ 4 424+2Évolution des étoiles sur les 7 derniers jours - #2
Moteur d'IA décisionnelle OpenDILab. Le framework d'apprentissage par renforcement le plus complet.
★ 3 642+1Évolution des étoiles sur les 7 derniers jours - #3
Cours tutoriel PPO x Family DRL (Cours public d'introduction à l'intelligence décisionnelle : 8 leçons pour maîtriser la théorie des algorithmes, la logique du code et les applications pratiques de l'IA décisionnelle).
★ 2 616+2Évolution des étoiles sur les 7 derniers jours - #4
[NeurIPS 2023 Spotlight] LightZero : un benchmark unifié pour la recherche arborescente de Monte Carlo (MCTS) dans des scénarios de décision séquentielle généraux.
★ 1 642+4Évolution des étoiles sur les 7 derniers jours - #5
Une liste organisée de ressources sur les modèles de diffusion en apprentissage par renforcement (mis à jour régulièrement).
★ 1 635+2Évolution des étoiles sur les 7 derniers jours - #6
Une liste organisée de ressources exceptionnelles sur l'apprentissage par renforcement basé sur des modèles (mise à jour continue).
★ 1 393+0Évolution des étoiles sur les 7 derniers jours - #7
Plateforme d'intelligence artificielle pour StarCraft II avec entraînement distribué à grande échelle et agents de niveau grand maître.
★ 1 393+0Évolution des étoiles sur les 7 derniers jours - #8
[CVPR 2024] LMDrive : Conduite de bout en bout en boucle fermée avec des modèles de langage étendus
★ 929+0Évolution des étoiles sur les 7 derniers jours - #9
Une liste organisée de ressources sur les Decision Transformers (mise à jour en continu).
★ 916+0Évolution des étoiles sur les 7 derniers jours - #10
Une liste de ressources exceptionnelles sur l'exploration en RL (mise à jour continue)
★ 723+0Évolution des étoiles sur les 7 derniers jours - #11
[CoRL 2022] InterFuser : Conduite autonome renforcée en sécurité utilisant Interpretable Sensor Fusion Transformer
★ 652-1Évolution des étoiles sur les 7 derniers jours - #12★ 639+1Évolution des étoiles sur les 7 derniers jours
- #13
Une liste organisée de ressources d'apprentissage par renforcement multimodal (mise à jour continuellement).
★ 620+1Évolution des étoiles sur les 7 derniers jours - #14
Reproduction/Démo open-source du jeu LLM Riddles
★ 587+0Évolution des étoiles sur les 7 derniers jours - #15
Agent interactif Speech-to-Speech haute qualité et en streaming implémenté dans un seul fichier.
★ 541+0Évolution des étoiles sur les 7 derniers jours - #16
3 Tiles Game et apprentissage par renforcement profond (Deep Reinforcement Learning).
★ 519+0Évolution des étoiles sur les 7 derniers jours