centerforaisafety/HarmBench
@centerforaisafetyHarmBench : un cadre d'évaluation standardisé pour le red teaming automatisé et le refus robuste.
Étoiles
1 042
Bifurcations
159
Langage
Jupyter Notebook
Licence
MIT
Dernier push
il y a 2 ans
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.