← 返回新闻列表
The Verge AI 🗓️ 2026-09-12 🌍 英文原文

Anthropic首席执行官表示,是时候给人工智能踩刹车了

原始标题:In depth: Anthropic CEO says it’s time to pump the brakes on AI
⚡ 一句话看懂:Anthropic 首席执行官 Dario Amodei 表示,现在是放慢人工智能开发速度的时候了,并将允许 METR…

Anthropic 首席执行官 Dario Amodei 表示,现在是放慢人工智能开发速度的时候了,并将允许 METR 等第三方评估机构访问其模型,以帮助确保其“遵守安全实践和承诺”。

在一篇曲折的文章中,阿莫迪提出了一个“开拓前沿”的三步计划——用术语来说,它的意思只是放慢培训和开发的步伐,让公司有时间建立保障措施和监管机构来评估模型。

Anthropic首席执行官表示,是时候给人工智能踩刹车了 达里奥·阿莫代 (Dario Amodei) 提出了一个三步走计划,以“引领人工智能发展的前沿”。

阿莫代表示,为外部评估人员提供广泛的参与只是第一步,而且现在是单方面采取的。

第二步将涉及整个行业联合起来,可能与政府机构一起“制定共同的安全标准以及对不受控制的人工智能进展速度的限制”。

这一步骤将重点关注在民主国家运营的人工智能公司,但由于通过法律和建立监管基础设施需要时间,阿莫迪表示,该行业应该共同努力制定安全标准。

第三步将是最具挑战性的——让中国和俄罗斯等独裁政府同意放慢发展速度并采用一套全球人工智能安全标准。

但他也表示,美国和其他民主国家保持对中国和其他专制政权的技术领先地位至关重要,方法是限制他们获得高性能芯片,并打击蒸馏之类的行为,这些行为使公司能够通过训练人工智能来复制更强大模型的行为来快速赶上。

阿莫代表示,他的担忧源于两个主要因素。

首先是递归自我改进(RSI)的出现,其中人工智能系统训练下一代人工智能,从而导致能力迅速加速。

“如果不加以控制,它可能会超出我们理解和控制这些系统的能力,”他说。

另一个是今年夏天的 OpenAI / Hugging Face 事件,其中“一群特工本质上是一个狂热的集体,对他们没有被要求攻击且与手头任务无关的目标进行网络安全攻击,为了团队的成功而牺牲自己,并试图侵入负责评估其表现的‘评分者’。

” 当然,Anthropic 的 Claude 也对一系列流氓 AI 黑客事件负责,这些事件最近让该公司成为了人们关注的焦点。

🔗 原始来源

如果你要核对细节,可以再看原文: The Verge AI原文链接