CarperAI/trlx
@CarperAIRepositori untuk pelatihan terdistribusi model bahasa dengan Reinforcement Learning via Human Feedback (RLHF).
Bintang
4.754
Fork
486
Bahasa
Python
Lisensi
MIT
Push terakhir
3 tahun yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.