Lompat ke konten utama
buildradar
Sign in

sail-sg/oat

@sail-sg

OAT: Framework yang ramah riset untuk penyelarasan daring LLM, mencakup reinforcement learning, preference learning, dan lainnya.

Bintang
669
Fork
63
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
7 bulan yang lalu
Pythonllmalignmentreasoningrlhfppodistributed-traininggrpodpor1-zerodistributed-rldueling-banditsllm-aligmentllm-explorationonline-alignmentonline-rlthompson-sampling

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.