Zum Hauptinhalt springen
buildradar
Sign in

natolambert/rlhf-book

@natolambert

Lehrbuch über Reinforcement Learning from Human Feedback

Sterne
2.357
Forks
258
Sprache
Python
Lizenz
NOASSERTION
Letzter Push
vor 5 Tagen
Pythonaialignmentrlhf

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.