Zum Hauptinhalt springen
buildradar
Anmelden

lucidrains/PaLM-rlhf-pytorch

@lucidrains

Implementierung von RLHF (Reinforcement Learning with Human Feedback) auf Basis der PaLM-Architektur. Im Grunde wie ChatGPT, nur mit PaLM

Sterne
7.866
Forks
673
Sprache
Python
Lizenz
MIT
Letzter Push
vor 1 Monat
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.