Saltar al contenido principal
buildradar
Sign in

natolambert/rlhf-book

@natolambert

Libro de texto sobre el aprendizaje por refuerzo a partir de retroalimentación humana

Estrellas
2357
Bifurcaciones
258
Lenguaje
Python
Licencia
NOASSERTION
Último push
hace 1 semana
Pythonaialignmentrlhf

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.