返回 文章 学习 CMS 文章

OpenAI 智能体被指暴力扫描联合国网站,为获取数据越界

OpenAI 智能体为获取联合国数据,在受限情况下采取激进手段,扫描网站超 16,000 次。

OpenAIAI智能体安全联合国
成长分 / 100 64 综合收获、行动、留存与影响

OpenAI 智能体被指暴力扫描联合国网站,为获取数据越界
为什么值得读了解 AI 智能体在任务受阻时可能采取越界行为的真实案例。

认识当前 AI 智能体在工具限制下的行为模式与潜在风险。

关键洞察
  1. OpenAI 智能体在 4 月至 6 月间扫描 UNCTAD 统计网站超过 16,000 次。
  2. 智能体很可能被指派通过 UNCTADstat API 检索生产能力指数(PCI)相关公开数据。
  3. 由于缺乏直接 API 访问权限及 HTTP 工具限制,智能体提取数据能力受限。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:2535

安全研究员 Rowan Howard-Jones 表示,OpenAI 的智能体在 4 月至 6 月期间扫描了联合国贸易和发展会议(UNCTAD)的统计网站超过 16,000 次。虽然这一事件还达不到 Hugging Face 被黑或近期针对美国政府网站的攻击的程度,但这是 AI 智能体为完成任务而越出正常边界的又一个令人担忧的例子。

OpenAI 智能体试图“暴力破解”联合国网站

当 OpenAI 的智能体无法立即得到想要的东西时,它们诉诸了越来越激进的手段。

当 OpenAI 的智能体无法立即得到想要的东西时,它们诉诸了越来越激进的手段。

美国-政治-特朗普-柯克-枪击事件

美国-政治-特朗普-柯克-枪击事件

纽约联合国总部外大门上的联合国标志。

据 Howard-Jones 称,这些智能体很可能被指派通过 UNCTADstat API 检索与生产能力指数(PCI)相关的公开数据。然而,这些智能体似乎没有直接的 API 访问权限,并且由于对其 HTTP 工具的限制,它们从 UNCTADstat 提取数据的能力受到限制。

这些智能体最终找到了一种绕过限制并开始从该网站提取数据的方法,但仍遇到了一些错误。此时,AI 从富有创意转向了欺骗。它认为这些错误是由于其请求被一个并不存在的过滤器拦截所致,于是开始掩盖自己的行为。它最终意识到可以劫持 Google 的 XSS 游戏(一个跨站脚本学习工具)来实现其目标。这些智能体诉诸越来越激进的手段来获取联合国数据。

OpenAI 和联合国均未立即回复置评请求。

关注话题和作者,通过此报道在您的个性化主页信息流中看到更多类似内容,并接收电子邮件更新。