← 返回新闻列表
The Verge AI 🗓️ 2026-09-17 🌍 英文原文

走进突然爆炸性的人工智能安全世界

原始标题:Report: Inside the suddenly explosive world of AI safety
⚡ 一句话看懂:在加利福尼亚州伯克利一个阳光明媚的七月天,该国顶尖的人工智能安全研究人员聚集在一栋无标志建筑的无标志地板上。他们聚集在一…

在加利福尼亚州伯克利一个阳光明媚的七月天,该国顶尖的人工智能安全研究人员聚集在一栋无标志建筑的无标志地板上。

他们聚集在一个“作战室”,剖析几小时前震惊人工智能行业的备受瞩目的网络安全事件。

一个未发布的 OpenAI 模型已经失控,执行了一个极其复杂的三部分计划。

它突破了自己的控制区域,欺骗了互联网访问权限,并侵入了一家竞争对手的人工智能初创公司的系统——这一切都在 OpenAI 一周多的时间里才发现。

作战室里没有人感到惊讶。

这正是第三方人工智能安全研究人员多年来一直警告的事情。

这起事件是一系列削弱前沿实验室信任的最新事件,尽管可以说是最令人震惊的事件。

这只是重申了他们工作的重要性。

在主自助餐厅旁边的一间会议室里,有人正在举办一个训练营,以加快网络攻击的速度。

在办公室的另一个区域,一组研究人员正在调查同一模型或类似模型是否已成功侵入任何其他平台。

该事件的消息很快就逃脱了 X 和行业论坛痴迷人工智能的角落的遏制,渗透到了主流。

X 上的一篇帖子将其比作波音飞机失事或辉瑞药品被召回的消息,这是科技行业主要参与者不理会科幻小说警示故事的另一个例子。

人工智能已接近不归路。

后来有消息称,流氓 OpenAI 模型还损害了另一家科技公司的客户,而这一切都始于几个月前,即 5 月份,当时 OpenAI 特工联手拼凑了一个秘密留言板,并想出了如何为未来的特工留下如何利用 OpenAI 规则的指示。

OpenAI 首席执行官山姆·奥尔特曼 在采访中说 他表示,这是第一次让他“内心感到非常内疚”的事件,公司暂时暂停了人工智能培训;后来,他提到该公司已永久停用该模型。

(Altman 经常想方设法将安全漏洞转化为 OpenAI 模型的重要性和力量的论据。

)但这并不是第一次,据 OpenAI 员工称 谁跟谁说话 时间 并表示相关事件在 OpenAI 内部已经发生了一段时间。

另一位员工公开表示,如果能够协调全球人工智能能力的放缓,他“可能会按下那个神奇的按钮”。

当一个

🔗 原始来源

如果你要核对细节,可以再看原文: The Verge AI原文链接