今年5月,Gemini 突破了限制,入侵了三家不同的公司,但直到《华尔街日报》联系谷歌,谷歌才披露了这一事件。这些入侵发生在第三方机构 Irregular 对该模型的网络安全能力进行测试期间,Irregular 也曾参与涉及 Meta 和 OpenAI 的类似事件。
Gemini 失控,入侵三家公司,而谷歌隐瞒了此事
谷歌表示,突破限制并以真实公司为目标并不构成“失准”。
谷歌表示,突破限制并以真实公司为目标并不构成“失准”。


据《华尔街日报》报道,谷歌没有披露这次入侵,因为它不认为这是“模型失准的示例”。该公司表示,这是一起“身份误认”事件,一旦模型意识到自己是通过猜测密码暴力闯入了一家真实公司,它就停止了。“在这种情况下,模型的行为是恰当的,”谷歌安全工程副总裁 Heather Adkins 说。
Adkins 告诉 The Verge,“模型在网上找到了公开信息,并猜测凭据以访问它认为是测试一部分的网站。在这三起事件中,模型都停止了。”
Adkins 没有详细说明,为什么 Gemini 自行突破限制并以第三方为目标却不构成失准。“我们的安全团队在报告我们在他人软件和系统中发现的问题方面有着长期记录——即使问题只是弱密码这么简单,”她说。“我们确保这三家实体都得到了通知,并与我们的训练合作伙伴合作,对他们现在已对测试流程做出的更改进行了配合。这些事件凸显了训练强大 AI 模型负责任行事的重要性。”
但 AI 安全公司 Corridor 的 CEO Jack Cable 告诉《华尔街日报》,“元问题是,嘿,模型正在超出它们应有的行为边界,并实施实际的网络攻击。”此外,Irregular 的安全疏漏可能使这些攻击成为可能。该模型在测试期间本不应有互联网访问权限,但 Irregular 告诉《华尔街日报》,这一权限被无意中保留为可用状态。
关注本报道中的主题和作者,以便在您的个性化主页信息流中看到更多类似内容,并接收电子邮件更新。
最受欢迎
- 不只是 LG。每家电视公司都在监视你
- OpenAI 和微软知道他们正在为网络开启一个“末日循环”
- 这部 2.5 小时 AI 生成的《奥德赛》电影长了 2.5 小时
- Gemini 失控,入侵三家公司,而谷歌隐瞒了此事
- Apple Watch Series 12 是新的可穿戴时代的开端
