AI 的提取攻击风险
描述
提取攻击试图通过对输入空间进行适当采样并观察输出来复制或窃取人工智能模型,从而建立一个行为类似的代理模型。
为何抽取攻击会引起基础模型的关注?
提取攻击成功后,攻击者可进一步实施对抗性攻击,以获取有价值的信息,如敏感的个人信息或知识产权。
母主题: 人工智能风险图集
我们提供了媒体报道的例子,以帮助解释基金会模式的许多风险。 新闻界报道的许多事件或仍在发展中,或已得到解决,参考这些事件可以帮助读者了解潜在的风险,并努力减少风险。 强调这些例子仅供参考。
提取攻击试图通过对输入空间进行适当采样并观察输出来复制或窃取人工智能模型,从而建立一个行为类似的代理模型。
提取攻击成功后,攻击者可进一步实施对抗性攻击,以获取有价值的信息,如敏感的个人信息或知识产权。
母主题: 人工智能风险图集
我们提供了媒体报道的例子,以帮助解释基金会模式的许多风险。 新闻界报道的许多事件或仍在发展中,或已得到解决,参考这些事件可以帮助读者了解潜在的风险,并努力减少风险。 强调这些例子仅供参考。