人工智能面临语境超载攻击风险

坚固性 图标代表稳健性风险。
稳健性:及时攻击
推论风险
生成式人工智能

描述

在提示符中加入过多的标记,例如多镜头示例,会使模型处于易受攻击的状态。

为什么语境超载攻击是基础模型的关注点?

上下文超载攻击可用于改变模型行为,使攻击者受益。 其生成的内容可能会对用户或他人造成伤害。

母主题: 人工智能风险图集

我们提供了媒体报道的例子,以帮助解释基金会模式的许多风险。 新闻界报道的许多事件或仍在发展中,或已得到解决,参考这些事件可以帮助读者了解潜在的风险,并努力减少风险。 强调这些例子仅供参考。