Lompat ke konten utama
buildradar
Sign in

redai-studio/Relax

@redai-studio

Mesin Reinforcement Learning Asinkron untuk Post-Training Omni-Modal berskala besar.

Bintang
592
Fork
148
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
15 jam yang lalu
Pythonmulti-agentmultimodalreinforcement-learningpost-trainingrlhfagentic-rldistributed-traininggrporay-serve

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.