Aller au contenu principal
buildradar
Se connecter

natolambert/rlhf-book

@natolambert

Manuel sur l'apprentissage par renforcement à partir de la rétroaction humaine (RLHF).

Étoiles
2 357
Bifurcations
258
Langage
Python
Licence
NOASSERTION
Dernier push
il y a 1 semaine
Pythonaialignmentrlhf

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.