人工智能面临语境超载攻击风险
描述
在提示符中加入过多的标记,例如多镜头示例,会使模型处于易受攻击的状态。
为什么语境超载攻击是基础模型的关注点?
上下文超载攻击可用于改变模型行为,使攻击者受益。 其生成的内容可能会对用户或他人造成伤害。
母主题: 人工智能风险图集
我们提供了媒体报道的例子,以帮助解释基金会模式的许多风险。 新闻界报道的许多事件或仍在发展中,或已得到解决,参考这些事件可以帮助读者了解潜在的风险,并努力减少风险。 强调这些例子仅供参考。
在提示符中加入过多的标记,例如多镜头示例,会使模型处于易受攻击的状态。
上下文超载攻击可用于改变模型行为,使攻击者受益。 其生成的内容可能会对用户或他人造成伤害。
母主题: 人工智能风险图集
我们提供了媒体报道的例子,以帮助解释基金会模式的许多风险。 新闻界报道的许多事件或仍在发展中,或已得到解决,参考这些事件可以帮助读者了解潜在的风险,并努力减少风险。 强调这些例子仅供参考。