Aller au contenu principal
buildradar
Sign in
Sujet · reinforcement-learning

reinforcement-learning

Dépôts open source suivis étiquetés reinforcement-learning, triés par étoiles.

305 dépôts
  • mushroom-rl@MushroomRL

    Bibliothèque Python pour l'apprentissage par renforcement.

    944+0Évolution des étoiles sur les 7 derniers jours
  • UniRL@Tencent-Hunyuan

    UniRL est un framework pour l'apprentissage par renforcement de modèles multimodaux unifiés.

    939+15Évolution des étoiles sur les 7 derniers jours
  • Mava@instadeepai

    Une base de code adaptée à la recherche pour l'expérimentation rapide de l'apprentissage par renforcement multi-agents dans JAX.

    934+1Évolution des étoiles sur les 7 derniers jours
  • UniLab@Motphys

    UniLab : une architecture hétérogène pour l'apprentissage par renforcement robotique au-delà des paradigmes dominés par les GPU

    926+18Évolution des étoiles sur les 7 derniers jours
  • maro@microsoft

    La plateforme Multi-Agent Resource Optimization (MARO) est une instance de Reinforcement Learning as a Service (RaaS) pour les problèmes d'optimisation des ressources dans le monde réel.

    923+1Évolution des étoiles sur les 7 derniers jours
  • Résumé des articles et blogs clés sur les modèles de diffusion pour apprendre le sujet. Liste détaillée de toutes les publications sur la robotique par diffusion.

    920+0Évolution des étoiles sur les 7 derniers jours
  • safe-control-gym@learnsyslab

    Environnements PyBullet CartPole et Quadrotor, avec dynamique symbolique a priori CasADi, pour le contrôle basé sur l'apprentissage et l'apprentissage par renforcement (RL).

    917+4Évolution des étoiles sur les 7 derniers jours
  • Une liste organisée de ressources sur les Decision Transformers (mise à jour en continu).

    917+1Évolution des étoiles sur les 7 derniers jours
  • Ressources CARLA incluant tutoriels, blog, code, etc. https://github.com/carla-simulator/carla

    915-1Évolution des étoiles sur les 7 derniers jours
  • hok_env@tencent-ailab

    Environnement ouvert d'IA pour Honor of Kings par Tencent.

    905+0Évolution des étoiles sur les 7 derniers jours
  • Une liste organisée de ressources sur l'apprentissage par renforcement profond (Deep Reinforcement Learning).

    900+0Évolution des étoiles sur les 7 derniers jours
  • rl4co@ai4co

    Une bibliothèque PyTorch dédiée à l'apprentissage par renforcement (RL) pour l'optimisation combinatoire (CO)

    900+0Évolution des étoiles sur les 7 derniers jours
  • iris@eloialonso

    Les Transformers sont des modèles de monde efficaces en termes d'échantillonnage. ICLR 2023, parmi les 5 % meilleurs.

    899-1Évolution des étoiles sur les 7 derniers jours
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    897+757Évolution des étoiles sur les 7 derniers jours
  • TienKung-Lab@Open-X-Humanoid

    Tien Kung-Lab : Workflow IsaacLab direct pour robots à pattes

    884+6Évolution des étoiles sur les 7 derniers jours
  • jumanji@instadeepai

    🕹️ Une suite diversifiée d'environnements d'apprentissage par renforcement évolutifs sous JAX.

    861+1Évolution des étoiles sur les 7 derniers jours
  • REINVENT4@MolecularAI

    Outil de conception moléculaire par IA pour le design de novo, le scaffold hopping, le remplacement de groupes R, le design de linkers et l'optimisation de molécules

    854+2Évolution des étoiles sur les 7 derniers jours
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus : Shadowing et imitation d'humanoïdes à partir d'humains

    849-1Évolution des étoiles sur les 7 derniers jours
  • JaxMARL@bold-lab-ai

    Apprentissage par renforcement multi-agents avec JAX.

    848+1Évolution des étoiles sur les 7 derniers jours
  • openrl@OpenRL-Lab

    Framework unifié d'apprentissage par renforcement.

    841+0Évolution des étoiles sur les 7 derniers jours
  • Une collection organisée d'outils d'IA, d'API, de jeux de données et de ressources d'apprentissage de haute qualité couvrant le machine learning, le deep learning, l'IA générative, le NLP et la science des données. Conçu pour aider les développeurs, les chercheurs et les créateurs à explorer et à construire avec l'IA plus rapidement.

    841+12Évolution des étoiles sur les 7 derniers jours
  • contextualbandits@david-cortes

    Implémentations en Python d'algorithmes de bandits contextuels.

    839+2Évolution des étoiles sur les 7 derniers jours
  • Ce dépôt contient des bases de référence pour l'apprentissage par renforcement sécurisé.

    814+1Évolution des étoiles sur les 7 derniers jours
  • Collection de projets publics remarquables sur les LLM, VLM, VLA, AIGC, ainsi que les jeux de données et applications associés.

    813-1Évolution des étoiles sur les 7 derniers jours
  • Collection organisée d'articles, de rapports techniques, de frameworks et d'outils pour la distillation on-policy (OPD) des grands modèles de langage

    803+32Évolution des étoiles sur les 7 derniers jours
  • awesome-isaac-gym@robotlearning123

    Une liste organisée de frameworks, articles, logiciels et ressources exceptionnels pour NVIDIA Isaac Gym.

    797+1Évolution des étoiles sur les 7 derniers jours
  • mobilegym@Purewhiter

    MobileGym : une plateforme de simulation vérifiable et hautement parallèle pour la recherche sur les agents d'interface graphique mobile, simulateur Android hébergé dans le navigateur, évaluation vérifiable, entraînement RL en ligne évolutif.

    787+5Évolution des étoiles sur les 7 derniers jours
  • BFM-Zero@LeCAR-Lab

    BFM_Zero : un modèle de fondation comportemental pilotable pour le contrôle d'humanoïdes utilisant l'apprentissage par renforcement non supervisé

    779+5Évolution des étoiles sur les 7 derniers jours
  • POMDPs.jl@JuliaPOMDP

    MDP et POMDP en Julia : une interface pour définir, résoudre et simuler des processus de décision markoviens totalement ou partiellement observables sur des espaces discrets et continus.

    767+2Évolution des étoiles sur les 7 derniers jours
  • panda-gym@qgallouedec

    Ensemble d'environnements robotiques basés sur le moteur physique PyBullet et gymnasium.

    766+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets