Aller au contenu principal
buildradar
Se connecter

lucidrains/PaLM-rlhf-pytorch

@lucidrains

Implémentation de RLHF (Apprentissage par renforcement à partir de rétroaction humaine) basée sur l'architecture PaLM. En somme, un équivalent de ChatGPT utilisant PaLM.

Étoiles
7 864
Bifurcations
673
Langage
Python
Licence
MIT
Dernier push
il y a 2 mois
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.