Propriétaire · PRIME-RL
PRIME-RL
Dépôts open source suivis de PRIME-RL, triés par étoiles.
3 dépôts
- #1
Solution d'apprentissage par renforcement (RL) évolutive pour le raisonnement avancé des modèles de langage
★ 1 871-1Évolution des étoiles sur les 7 derniers jours - #2
[ICLR 2026] SimpleVLA-RL : Mise à l'échelle de l'entraînement VLA via l'apprentissage par renforcement.
★ 1 844+6Évolution des étoiles sur les 7 derniers jours - #3
[NeurIPS 2025] TTRL : Apprentissage par renforcement en temps de test (Test-Time Reinforcement Learning).
★ 1 122+2Évolution des étoiles sur les 7 derniers jours