Lompat ke konten utama
buildradar
Sign in

voidful/TextRL

@voidful

Implementasi ChatGPT RLHF (Reinforcement Learning with Human Feedback) pada model bangkitan apa pun di transformer huggingface (bloomz-176B/bloom/gpt/bart/T5/MetaICL)

Bintang
564
Fork
61
Bahasa
Python
Lisensi
MIT
Push terakhir
4 bulan yang lalu
Pythonlanguage-modelpytorchchatgptreinforcement-learningnlpgpt-3rlhfgpt-2controlled-nlgnlg

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.