Zum Hauptinhalt springen
buildradar
Sign in

NVlabs/QeRL

@NVlabs

[ICLR 2026] QeRL ermöglicht RL für 32B LLMs auf einer einzelnen H100 GPU.

Sterne
518
Forks
53
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 5 Monaten
Pythonllmsreinforcement-learningquantizationreasoning

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.