Aller au contenu principal
buildradar
Se connecter

ChenxinAn-fdu/POLARIS

@ChenxinAn-fdu

Mise à l'échelle de l'apprentissage par renforcement (RL) sur des modèles de raisonnement avancés

Étoiles
696
Bifurcations
43
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 11 mois
Python

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.