Zum Hauptinhalt springen
buildradar
Sign in

petergpt/bullshit-benchmark

@petergpt

BullshitBench misst, ob KI-Modelle unsinnige Prompts hinterfragen, anstatt sie selbstbewusst zu beantworten; erstellt von Peter Gostev.

Sterne
1.844
Forks
73
Sprache
Python
Lizenz
MIT
Letzter Push
vor 1 Woche
Python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.