Lompat ke konten utama
buildradar
Masuk

lucidrains/PaLM-rlhf-pytorch

@lucidrains

Implementasi RLHF (Reinforcement Learning with Human Feedback) di atas arsitektur PaLM. Pada dasarnya seperti ChatGPT tetapi menggunakan PaLM

Bintang
7.866
Fork
673
Bahasa
Python
Lisensi
MIT
Push terakhir
2 bulan yang lalu
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.