Pular para o conteúdo principal
buildradar
Entrar

tatsu-lab/alpaca_farm

@tatsu-lab

Um framework de simulação para RLHF e alternativas. Desenvolva seu método RLHF sem coletar dados humanos.

Estrelas
844
Bifurcações
66
Linguagem
Python
Licença
Apache-2.0
Último push
há 2 anos
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.