Propriétaire · TsinghuaC3I
TsinghuaC3I
Dépôts open source suivis de TsinghuaC3I, triés par étoiles.
3 dépôts
- #1
Une étude sur l'apprentissage par renforcement pour les grands modèles de raisonnement
★ 2 483+1Évolution des étoiles sur les 7 derniers jours - #2
Une collection d'articles sur la mémoire pour les agents linguistiques
★ 653+7Évolution des étoiles sur les 7 derniers jours - #3
Un framework pour l'entraînement et l'inférence multi-agents basés sur les LLM par renforcement
★ 555+3Évolution des étoiles sur les 7 derniers jours