← 返回新闻列表
TechCrunch AI 🗓️ 2026-09-14 🌍 英文原文

微软新的人工智能“行为准则”告诉模型不要侵入系统或欺骗人类

原始标题:Update: Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans
⚡ 一句话看懂:该行为准则列出了微软人工智能模型应遵循的一般原则——例如支持人类而不是取代人类,以及加速人类繁荣——以及旨在实施这些原则…

随着人工智能世界将重点转向安全和一致性,微软发布了 新的人工智能行为准则 旨在引导人工智能模型远离危险行为。

该文档的级别比 Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 最近呼吁开拓前沿 ,而不是关注指导 Microsoft AI 中模型训练的价值观和红线。

尽管如此,其结果仍然是关于微软如何实现人工智能安全以及如何在实践中实施这些想法的全面指南。

该文件首先预测,在未来十年中,超级智能人工智能系统将在大多数任务中超越人类的表现。

该行为准则指出:“遏制、控制和调整如此强大的力量是人类有史以来面临的最大挑战之一。

” “因此,我们必须完全清楚我们为什么要发明这些系统以及我们打算如何控制它们。

” 该行为准则还列出了微软人工智能模型应遵循的一般原则——例如支持人类而不是取代人类,以及加速人类繁荣——以及旨在实施这些原则的具体安全限制。

在微软的系统下,每个模型都有一个总体行为准则,该准则优先于个人用户的偏好或任何特定任务。

这包括禁止网络攻击、核武器或深度造假生产的“绝对限制”。

它还包括针对普遍失去人类控制的更广泛的规定。

🔗 原始来源

如果你要核对细节,可以再看原文: TechCrunch AI原文链接