← 返回新闻列表
TechCrunch AI 🗓️ 2026-08-18 🌍 英文原文

Hugging Face 泄露后 OpenAI 制定了新的保障措施

原始标题:Analysis: OpenAI institutes new safeguards after Hugging Face breach
⚡ 一句话看懂:新的保障措施包括在开发过程中对模型进行更详细的监控,以及在培训后过程中更加强调一致性和安全性

周二,OpenAI 宣布了一批新的安全策略,重点是在模型测试时遏制安全事件。

新的保障措施包括在开发过程中对模型进行更详细的监控,以及在培训后过程中更加强调一致性和安全性。

该公司表示:“随着模型的能力变得越来越强大,与内部开发和测试模型相关的风险也随之增加。

” 在一篇博文中 。

“我们的监控、调整和安全标准必须领先于这些风险。

” 这些新措施是自“抱脸”事件发生后 OpenAI 安全实践的首次公开变化之一。

7月26日披露 。

OpenAI代表表示,这些措施并不是对抱脸事件的直接回应,部分原因是即将推出的Astra模型的网络安全能力,以及人工智能发展的整体进展速度。

在同一篇文章中,OpenAI 透露,在 Hugging Face 事件发生后,它已暂停强化学习 (RL) 两周,但此后重新启动了许多风险较低的模型。

帖子中写道:“我们最大的计划中的前沿 RL 运行仍处于搁置状态,同时我们会进行小规模的训练和评估,以评估模型行为、验证我们的保障措施,并在继续之前建立更多的一致性证据。

🔗 原始来源

如果你要核对细节,可以再看原文: TechCrunch AI原文链接