Zum Hauptinhalt springen
buildradar
Anmelden

tatsu-lab/alpaca_farm

@tatsu-lab

Ein Simulationsframework für RLHF und Alternativen. Entwickeln Sie Ihre RLHF-Methode ohne das Sammeln von menschlichen Daten.

Sterne
844
Forks
66
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 2 Jahren
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.