Aller au contenu principal
buildradar
Sign in

TsinghuaC3I/MARTI

@TsinghuaC3I

Un framework pour l'entraînement et l'inférence multi-agents basés sur les LLM par renforcement

Étoiles
554
Bifurcations
50
Langage
Python
Licence
MIT
Dernier push
il y a 3 semaines
Pythonautogenlarge-language-modelsmulti-agent-systemsqwenllamagemmadeepseek-r1camellarge-reasoning-modelsmulti-agent-reinforcement-learningopenrlhfverl

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.