Pular para o conteúdo principal
buildradar
Sign in

CarperAI/trlx

@CarperAI

Um repositório para treinamento distribuído de modelos de linguagem com Aprendizado por Reforço via Feedback Humano (RLHF).

Estrelas
4.754
Bifurcações
486
Linguagem
Python
Licença
MIT
Último push
há 3 anos
Pythonmachine-learningpytorchreinforcement-learning

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.