Zum Hauptinhalt springen
buildradar
Sign in

redai-studio/Relax

@redai-studio

Eine asynchrone Reinforcement-Learning-Engine für skaliertes Omni-Modal Post-Training.

Sterne
592
Forks
148
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 18 Stunden
Pythonmulti-agentmultimodalreinforcement-learningpost-trainingrlhfagentic-rldistributed-traininggrporay-serve

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.