Lompat ke konten utama
buildradar
Sign in

RobustNLP/CipherChat

@RobustNLP

Sebuah framework untuk mengevaluasi kemampuan generalisasi dari safety alignment untuk LLM

Bintang
629
Fork
67
Bahasa
Python
Lisensi
MIT
Push terakhir
11 bulan yang lalu
Pythonsecurityllmlarge-language-modelschatgptalignmentjailbreakgpt-4-0613

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.