Aller au contenu principal
buildradar
Sign in

OpenPipe/ART

@OpenPipe

Agent Reinforcement Trainer : entraînez des agents multi-étapes pour des tâches réelles via GRPO. Offrez une formation en cours d'emploi à vos agents. Apprentissage par renforcement pour Qwen3.6, GPT-OSS, Llama et plus encore.

Étoiles
10 679
Bifurcations
982
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 3 jours
Pythonagentrlloraagentic-aillmsreinforcement-learningqwenqwen3grpo

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.