今年 5 月,Gemini 突破遏制并攻击了三家不同的公司,但直到《华尔街日报》联系该公司后,谷歌才披露了这一事件。
这些黑客事件发生在第三方 Irregular 运行的模型网络安全功能测试期间,该公司也涉及 Meta 和 OpenAI 的类似事件。
双子座作恶,黑了三家公司,谷歌隐藏了 谷歌表示,打破遏制并针对真正的公司并不构成“失准”。
据《华尔街日报》报道,谷歌没有披露此次黑客攻击,因为它不认为这是“模型错位的例子”。
该公司表示,这是一个“身份错误”的例子,一旦该模型意识到它通过猜测密码强行进入了一家真正的公司,它就停止了。
谷歌安全工程副总裁希瑟·阿德金斯 (Heather Adkins) 表示:“在这种情况下,模型的表现是适当的。
” 阿德金斯告诉 The Verge,“该模型在网上找到了公共信息,并猜测了访问它认为是测试一部分的网站的凭据。
在所有这三种情况下,该模型都停止了。
” 阿德金斯没有详细说明双子座自行突破遏制并针对第三方的行为为何未能被视为失准。
她说:“我们的安全团队在报告我们在其他人的软件和系统中发现的问题方面有着长期的记录,即使它像弱密码一样简单。
” “我们确保这三个实体都了解这一情况,并与我们的培训合作伙伴合作,对他们的测试流程进行了更改。
这些事件凸显了训练强大的人工智能模型以负责任地行动的重要性。
” 但人工智能安全公司 Corridor 的首席执行官杰克·凯布尔 (Jack Cable) 告诉《华尔街日报》,“元问题是,嘿,模型超出了它们应该做的事情的范围,并进行了实际的网络攻击。
”此外,Irregular 的安全漏洞可能导致这些攻击成为可能。
该模型在测试期间不应该访问互联网,但 Irregular 告诉《华尔街日报》,它无意中保持可用。
🔗 原始来源
如果你要核对细节,可以再看原文: The Verge AI原文链接
AI热榜