Aller au contenu principal
buildradar
Sign in
Propriétaire · PRIME-RL

PRIME-RL

Dépôts open source suivis de PRIME-RL, triés par étoiles.

3 dépôts
  • PRIME@PRIME-RL

    Solution d'apprentissage par renforcement (RL) évolutive pour le raisonnement avancé des modèles de langage

    1 871-1Évolution des étoiles sur les 7 derniers jours
  • SimpleVLA-RL@PRIME-RL

    [ICLR 2026] SimpleVLA-RL : Mise à l'échelle de l'entraînement VLA via l'apprentissage par renforcement.

    1 844+6Évolution des étoiles sur les 7 derniers jours
  • TTRL@PRIME-RL

    [NeurIPS 2025] TTRL : Apprentissage par renforcement en temps de test (Test-Time Reinforcement Learning).

    1 122+2Évolution des étoiles sur les 7 derniers jours
← Retour au classement des propriétaires