Lompat ke konten utama
buildradar
Sign in

mll-lab-nu/RAGEN

@mll-lab-nu

Kerangka kerja Agent RL untuk agen LLM: reinforcement learning multi-putaran dengan StarPO dan diagnostik reasoning-collapse

Bintang
2.786
Fork
227
Bahasa
Python
Lisensi
MIT
Push terakhir
2 minggu yang lalu
Pythonllm-agentsagentic-aireinforcement-learningagent-rlmulti-turn-rlrl-framework

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.