Saltar al contenido principal
buildradar
Iniciar sesión

walkinglabs/hands-on-modern-rl

@walkinglabs

🚀 Un plan de estudios práctico y de código abierto que puentea la brecha desde los conceptos básicos de RL hasta la alineación de LLM, RLVR y sistemas de agentes avanzados.

Estrellas
4199
Bifurcaciones
303
Lenguaje
Python
Licencia
NOASSERTION
Último push
hace 2 semanas
Pythonagentllmrlpytorchtutorialagentic-aireinforcement-learningagenticrlhfppoagentic-rlgrpodposftreinforcementllm-alignment

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.