Lompat ke konten utama
buildradar
Masuk

natolambert/rlhf-book

@natolambert

Buku teks tentang reinforcement learning from human feedback

Bintang
2.357
Fork
258
Bahasa
Python
Lisensi
NOASSERTION
Push terakhir
1 minggu yang lalu
Pythonaialignmentrlhf

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.