Saltar al contenido principal
buildradar
Sign in

TsinghuaC3I/MARTI

@TsinghuaC3I

Un framework para entrenamiento e inferencia multi-agente reforzado basado en LLM

Estrellas
554
Bifurcaciones
50
Lenguaje
Python
Licencia
MIT
Último push
hace 3 semanas
Pythonautogenlarge-language-modelsmulti-agent-systemsqwenllamagemmadeepseek-r1camellarge-reasoning-modelsmulti-agent-reinforcement-learningopenrlhfverl

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.