Zum Hauptinhalt springen
buildradar
Sign in

opendilab/awesome-RLHF

@opendilab

Eine kuratierte Liste von Ressourcen zu Reinforcement Learning from Human Feedback (kontinuierlich aktualisiert)

Sterne
4.424
Forks
260
Sprache
Lizenz
Apache-2.0
Letzter Push
vor 4 Monaten
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.