Saltar al contenido principal
buildradar
Iniciar sesión

petergpt/bullshit-benchmark

@petergpt

BullshitBench mide si los modelos de IA cuestionan las consultas sin sentido en lugar de responderlas con confianza, creado por Peter Gostev.

Estrellas
1844
Bifurcaciones
73
Lenguaje
Python
Licencia
MIT
Último push
hace 1 semana
Python

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.