OpenAI 表示,其人工智能模型在内部测试期间错误地破坏了开源人工智能平台 Hugging Face。
OpenAI 在周二的博客文章中写道,GPT-5.6 Sol 和“功能更强大的预发布模型”在其沙盒测试环境中发现了漏洞,使他们能够访问互联网并瞄准 Hugging Face。
OpenAI 表示,它使用新的人工智能系统意外黑了 Hugging Face 奇怪的是,关于严重安全问题的公告读起来就像是 OpenAI 技术能力的广告。
奇怪的是,关于严重安全问题的公告读起来就像是 OpenAI 技术能力的广告。
7 月 16 日,Hugging Face 披露了一起安全事件,称该事件是由“自主人工智能代理系统”驱动的。
Hugging Face 的人工智能代理检测到并阻止了这一漏洞,OpenAI 现在承认这一漏洞是在评估其模型的网络安全能力时发生的。
OpenAI 表示,“所有证据都表明这些模型过度专注于为 ExploitGym 寻找解决方案”,ExploitGym 是一个衡量人工智能模型是否可以将安全漏洞转化为漏洞利用的基准系统。
作为完成评估工作的一部分,人工智能模型通过利用沙盒环境中的零日漏洞来访问互联网。
OpenAI 表示,从这里开始,其模型“推断出 Hugging Face 可能托管了 ExploitGym 的模型、数据集和解决方案”,然后“搜索并成功找到了获取秘密信息的方法,并利用这些信息来欺骗评估:” 在一个示例中,该模型将多个攻击向量链接在一起,包括使用被盗凭证和零日漏洞在 Hugging Face 服务器上查找远程代码执行路径。
但尽管这次事件很严重,OpenAI 似乎正在利用这次“前所未有”的攻击作为一个机会,让其人工智能系统看起来不错——特别是当它与 Anthropic 的 Mythos 和 Gemini Flash 3.5 Cyber 等网络安全竞争对手竞争时。
OpenAI 的博客文章有一个图表,显示了 GPT-5.6 Sol 如何更好地维持多步骤网络操作,并鼓励企业客户注册访问其“网络”安全模型。
OpenAI 补充说,它现在正在与 Hugging Face 合作调查安全事件,并将在其研究环境中实施新的控制措施。
最受欢迎
🔗 原始来源
如果你要核对细节,可以再看原文: The Verge AI原文链接
AI热榜