Aller au contenu principal
buildradar
Se connecter

TsinghuaC3I/Awesome-RL-for-LRMs

@TsinghuaC3I

Une étude sur l'apprentissage par renforcement pour les grands modèles de raisonnement

Étoiles
2 487
Bifurcations
133
Langage
TeX
Licence
MIT
Dernier push
il y a 3 semaines
TeXopen-sourceawesome-listllmrlreasoningdeepseek-r1lrm

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.