Zum Hauptinhalt springen
buildradar
Sign in

OpenPipe/ART

@OpenPipe

Agent Reinforcement Trainer: Trainieren Sie mehrstufige Agenten für reale Aufgaben mit GRPO. Geben Sie Ihren Agenten ein On-the-Job-Training. Reinforcement Learning für Qwen3.6, GPT-OSS, Llama und mehr!

Sterne
10.679
Forks
982
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 3 Tagen
Pythonagentrlloraagentic-aillmsreinforcement-learningqwenqwen3grpo

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.