Zum Hauptinhalt springen
buildradar
Sign in

CarperAI/trlx

@CarperAI

Ein Repository für das verteilte Training von Sprachmodellen mit Reinforcement Learning via Human Feedback (RLHF)

Sterne
4.754
Forks
486
Sprache
Python
Lizenz
MIT
Letzter Push
vor 3 Jahren
Pythonmachine-learningpytorchreinforcement-learning

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.