Pular para o conteúdo principal
buildradar
Entrar

walkinglabs/hands-on-modern-rl

@walkinglabs

Um currículo prático de código aberto que preenche a lacuna entre conceitos básicos de RL e alinhamento de LLM, RLVR e sistemas de agentes avançados.

Estrelas
4.199
Bifurcações
303
Linguagem
Python
Licença
NOASSERTION
Último push
há 2 semanas
Pythonagentllmrlpytorchtutorialagentic-aireinforcement-learningagenticrlhfppoagentic-rlgrpodposftreinforcementllm-alignment

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.