Saltar al contenido principal
buildradar
Sign in

CarperAI/trlx

@CarperAI

Un repositorio para el entrenamiento distribuido de modelos de lenguaje con aprendizaje por refuerzo a partir de retroalimentación humana (RLHF)

Estrellas
4754
Bifurcaciones
486
Lenguaje
Python
Licencia
MIT
Último push
hace 3 años
Pythonmachine-learningpytorchreinforcement-learning

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.