跳到主要內容
buildradar
登入

petergpt/bullshit-benchmark

@petergpt

BullshitBench 用於衡量 AI 模型是否會質疑無意義的提示詞,而不是自信地回答它們,由 Peter Gostev 建立。

星數
1,844
Fork 數
73
語言
Python
授權
MIT
最後推送
1 週前
Python

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。