Pular para o conteúdo principal
buildradar
Entrar

opendilab/awesome-RLHF

@opendilab

Uma lista curada de recursos sobre aprendizado por reforço com feedback humano (atualizada continuamente).

Estrelas
4.424
Bifurcações
260
Linguagem
Licença
Apache-2.0
Último push
há 4 meses
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.