Saltar al contenido principal
buildradar
Sign in

OpenPipe/ART

@OpenPipe

Agent Reinforcement Trainer: entrena agentes multipaso para tareas del mundo real utilizando GRPO. Dale a tus agentes entrenamiento práctico. ¡Aprendizaje por refuerzo para Qwen3.6, GPT-OSS, Llama y más!

Estrellas
10.689
Bifurcaciones
980
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 4 días
Pythonagentrlloraagentic-aillmsreinforcement-learningqwenqwen3grpo

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.