Saltar al contenido principal
buildradar
Iniciar sesión

opendilab/awesome-RLHF

@opendilab

Una lista seleccionada de recursos sobre aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)

Estrellas
4424
Bifurcaciones
260
Lenguaje
Licencia
Apache-2.0
Último push
hace 4 meses
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.