Saltar al contenido principal
buildradar
Iniciar sesión

tatsu-lab/alpaca_farm

@tatsu-lab

Un marco de simulación para RLHF y alternativas. Desarrolle su método de RLHF sin recopilar datos humanos.

Estrellas
844
Bifurcaciones
66
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 2 años
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.