Pular para o conteúdo principal
buildradar
Entrar

lucidrains/PaLM-rlhf-pytorch

@lucidrains

Implementação de RLHF (Aprendizado por Reforço com Feedback Humano) sobre a arquitetura PaLM. Basicamente o ChatGPT, mas com PaLM.

Estrelas
7.864
Bifurcações
673
Linguagem
Python
Licença
MIT
Último push
há 2 meses
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.