Zum Hauptinhalt springen
buildradar
Sign in

mll-lab-nu/RAGEN

@mll-lab-nu

RAGEN nutzt Reinforcement Learning, um LLM-Reasoning-Agenten in interaktiven, stochastischen Umgebungen zu trainieren.

Sterne
2.786
Forks
227
Sprache
Python
Lizenz
MIT
Letzter Push
vor 2 Wochen
Pythonllm-agentsagentic-aireinforcement-learningagent-rlmulti-turn-rlrl-framework

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.