Lompat ke konten utama
buildradar
Masuk

petergpt/bullshit-benchmark

@petergpt

BullshitBench mengukur apakah model AI menantang prompt yang tidak masuk akal alih-alih menjawabnya dengan percaya diri, dibuat oleh Peter Gostev.

Bintang
1.844
Fork
73
Bahasa
Python
Lisensi
MIT
Push terakhir
1 minggu yang lalu
Python

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.