提示人工智能的潜在风险

坚固性 图标代表稳健性风险。
稳健性:及时攻击
推断风险
生成式人工智能

描述

由于生成式模型是根据所提供的输入信息生成输出结果的,因此可以促使模型揭示特定类型的信息。 例如,在提示中添加个人信息会增加其输出中生成类似种类的个人信息的可能性。 如果将个人数据作为模型训练的一部分包含在内,那么可能会显示这些数据。

为什么提示引发对基础模型的关注?

攻击可用于改变模型行为,使攻击者受益。

母主题: 人工智能风险图集

我们提供了媒体报道的例子,以帮助解释基金会模式的许多风险。 新闻界报道的许多事件或仍在发展中,或已得到解决,参考这些事件可以帮助读者了解潜在的风险,并努力减少风险。 强调这些例子仅供参考。