Zum Hauptinhalt springen
buildradar
Sign in

RLHFlow/RLHF-Reward-Modeling

@RLHFlow

Rezepte zum Trainieren von Belohnungsmodellen für RLHF.

Sterne
1.541
Forks
110
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 1 Jahr
Pythonllmllama3rlhfreward-models

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.