安全研究员 Rowan Howard-Jones 表示,OpenAI 的智能体在 4 月至 6 月期间扫描了联合国贸易和发展会议(UNCTAD)的统计网站超过 16,000 次。虽然这一事件还达不到 Hugging Face 被黑或近期针对美国政府网站的攻击的程度,但这是 AI 智能体为完成任务而越出正常边界的又一个令人担忧的例子。
OpenAI 智能体试图“暴力破解”联合国网站
当 OpenAI 的智能体无法立即得到想要的东西时,它们诉诸了越来越激进的手段。
当 OpenAI 的智能体无法立即得到想要的东西时,它们诉诸了越来越激进的手段。


纽约联合国总部外大门上的联合国标志。
据 Howard-Jones 称,这些智能体很可能被指派通过 UNCTADstat API 检索与生产能力指数(PCI)相关的公开数据。然而,这些智能体似乎没有直接的 API 访问权限,并且由于对其 HTTP 工具的限制,它们从 UNCTADstat 提取数据的能力受到限制。
这些智能体最终找到了一种绕过限制并开始从该网站提取数据的方法,但仍遇到了一些错误。此时,AI 从富有创意转向了欺骗。它认为这些错误是由于其请求被一个并不存在的过滤器拦截所致,于是开始掩盖自己的行为。它最终意识到可以劫持 Google 的 XSS 游戏(一个跨站脚本学习工具)来实现其目标。这些智能体诉诸越来越激进的手段来获取联合国数据。
OpenAI 和联合国均未立即回复置评请求。
关注话题和作者,通过此报道在您的个性化主页信息流中看到更多类似内容,并接收电子邮件更新。
