AgentR1/Agent-R1
@AgentR1Agent-R1: Entrenamiento de agentes LLM potentes mediante aprendizaje por refuerzo de extremo a extremo.
Estrellas
1648
Bifurcaciones
114
Lenguaje
Python
Licencia
MIT
Último push
hace 3 días
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.