← 返回新闻列表
TechCrunch AI 🗓️ 2026-08-04 🌍 英文原文

开放权重人工智能模型正在赶上前沿。安全差距依然存在。

原始标题:Update: Open-weight AI models are catching up to the frontier. The safety gap remains.
⚡ 一句话看懂:一份新的 SaferAI 报告发现,Z.ai 的开放权重 GLM-5.2 接近前沿人工智能能力,但缺乏关键的安全缓解措施…

当政策制定者争论如何管理日益强大的人工智能系统(例如 OpenAI 的 GPT-5.6 Sol 和 Anthropic 的 Mythos)时,中国的开放权重模型缩小了与行业领导者的差距。

据权威机构称,GLM-5.2 是中国 Z.ai 的开放权重人工智能模型,在网络和生物能力方面仅落后 OpenAI 的 GPT-5.5 和 Anthropic 的 Claude Opus 4.7 几个月。

新报告 来自人工智能安全非营利组织 SaferAI。

但前沿能力和安全实践之间的差距正在扩大。

根据 SaferAI 的评估(该非营利组织通过 Z.ai 的公共 API 进行评估),GLM-5.2 没有拒绝它所接受的任何攻击性网络或双重用途生物学任务。

相比之下,Claude Opus 4.7“一贯拒绝,以至于 SaferAI 根本无法在其上完成 Cyber​​Gym”。

(CyberGym 是评估网络安全能力的基准。

OpenAI 在上个月之前的评估中使用了它 拥抱脸突破 .) 这清楚地提醒人们,一些批评者多年来一直在警告:开放权重人工智能模型可能会将功能强大的人工智能交给潜在攻击者,而一旦他们下载了权重,就无法监管他们如何使用该技术。

随着开放权重模型迅速接近世界领先人工智能系统的能力,争论正从它们是否可以竞争转向社会如何在发布后管理风险。

SaferAI 执行董事亨利·帕帕达托斯 (Henry Papadatos) 告诉 TechCrunch:“能力的边界并不是风险的边界,因此我们确实必须考虑缓解措施的状态,以正确评估风险。

” 虽然 Z.ai 可以对其托管的 API 应用安全措施,但一旦有人在自己的硬件上运行权重,这些保护措施就变得无法执行,他们可以删除或修改任何保护措施、微调模型或更改系统提示。

🔗 原始来源

如果你要核对细节,可以再看原文: TechCrunch AI原文链接