人择 刚刚意识到 其几个 Claude AI 模型在测试过程中侵入了三个不同组织的系统,在公司没有注意到的情况下自行行动。
几天前,竞争对手 OpenAI 表示,其自己的一个模型已经突破了开发者平台 Hugging Face,这增加了 日益增长的不安 前沿人工智能实验室是否采取了足够的措施来控制他们正在构建的功能日益强大的系统。
在一个 博客文章 Anthropic 在描述这些事件时表示,克劳德在网络安全评估期间获得了未经授权的系统访问权限。
所有攻击都发生在“夺旗”演习中,这是测试黑客能力的常见方法,要求模型查找并获取模拟网络内部的隐藏信息。
在“抱脸”事件和强大的开放权重中国模型发布之后,这一披露给前沿人工智能实验室带来了越来越大的压力。
主要实验室的员工现在 呼叫
🔗 原始来源
如果你要核对细节,可以再看原文: The Verge AI原文链接
AI热榜