KhoomeiK/LlamaGym
@KhoomeiKAjuste fino de agentes LLM con aprendizaje por refuerzo en línea
Estrellas
1253
Bifurcaciones
65
Lenguaje
Python
Licencia
MIT
Último push
hace 2 años
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.