新报告 Anthropic 周四发布 据称,中国人工智能公司持续发起蒸馏攻击,近几个月来,随着该领域竞争的加剧,攻击不断升级。
报告称:“在过去的几个月里,未经授权的实验室开发出了越来越复杂的方法来绕过我们的防御并获取美国前沿模型的能力。
” “我们发现的活动针对的是克劳德的一些最有价值的能力,包括代理能力和工具使用、编码和数据分析以及逻辑推理。
” Anthropic 此前曾谈到蒸馏攻击 二月 ,甚至呼叫特定的实验室。
OpenAI 报告了类似的活动,它 特别归功于 DeepSeek 。
但 Anthropic 的新报告中详细介绍的活动规模更大、更具侵略性。
总而言之,该公司观察到近 2 亿次与蒸馏攻击相关的交易,归因于五个不同的活动。
从广义上讲,蒸馏攻击的重点是从模型对各种查询的响应中提取思想链。
然后,可以使用该思路通过监督微调来训练具有一般推理能力的较小模型。
🔗 原始来源
如果你要核对细节,可以再看原文: TechCrunch AI原文链接
AI热榜