mll-lab-nu/RAGEN
@mll-lab-nuKerangka kerja Agent RL untuk agen LLM: reinforcement learning multi-putaran dengan StarPO dan diagnostik reasoning-collapse
Bintang
2.786
Fork
227
Bahasa
Python
Lisensi
MIT
Push terakhir
2 minggu yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.