跳到主要内容
buildradar
登录

agencyenterprise/PromptInject

@agencyenterprise

PromptInject 是一个以模块化方式组合提示词的框架,用于对 LLM 对抗性提示攻击的稳健性进行定量分析。荣获 NeurIPS ML Safety Workshop 2022 最佳论文奖。

星数
523
Fork 数
55
语言
Python
许可
MIT
最后推送
4个月前
Pythonmachine-learningprompt-engineeringlarge-language-modelschain-of-thoughtai-safetylanguage-modelsgpt-3adversarial-attacksagiagi-alignmentai-alignmentml-safety

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。