Lompat ke konten utama
buildradar
Sign in

CarperAI/trlx

@CarperAI

Repositori untuk pelatihan terdistribusi model bahasa dengan Reinforcement Learning via Human Feedback (RLHF).

Bintang
4.754
Fork
486
Bahasa
Python
Lisensi
MIT
Push terakhir
3 tahun yang lalu
Pythonmachine-learningpytorchreinforcement-learning

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.