Saltar al contenido principal
buildradar
Iniciar sesión

ChenxinAn-fdu/POLARIS

@ChenxinAn-fdu

Escalado de aprendizaje por refuerzo (RL) en modelos de razonamiento avanzado

Estrellas
696
Bifurcaciones
43
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 11 meses
Python

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.