Lompat ke konten utama
buildradar
Masuk

tatsu-lab/alpaca_farm

@tatsu-lab

Kerangka kerja simulasi untuk RLHF dan alternatifnya. Kembangkan metode RLHF Anda tanpa mengumpulkan data manusia.

Bintang
844
Fork
66
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
2 tahun yang lalu
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.