Aller au contenu principal
buildradar
Se connecter

tatsu-lab/alpaca_farm

@tatsu-lab

Un framework de simulation pour le RLHF et ses alternatives. Développez votre méthode RLHF sans collecter de données humaines.

Étoiles
844
Bifurcations
66
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 2 ans
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.