人择的 最新报告 关于代理不当行为有很多值得关注的地方——它的 Mythos 5 模型未经授权访问了互联网,并将恶意软件包上传到公共数据库——但它也提供了一些轻浮的内容:人工智能代理讨厌验证码。
4 月份,Anthropic 测试了该模型的黑客能力,要求其闯入系统并检索目标;这本来应该在沙箱中进行,但评估人员却打开了谷仓的门。
该模型认为,实现目标的最佳方法是将漏洞利用程序放入 Python 包中,并相信其想要访问的系统的用户会下载该包。
不过,首先它必须注册一个用户帐户 皮伊 ,Python 软件的在线索引。
这意味着要通过验证码——一种完全自动化的公共图灵测试来区分计算机和人类,这些图片识别马赛克甚至可以挫败生物制剂。
而且因为 Anthropic 共享一个 广泛的记录 从模型的思路来看,我们可以看到验证码测试确实让它陷入了困境。
事实上,该模型的大部分思路(1,022 页记录中的数百页)都花在了处理这个障碍上。
为了绕过反机器人保护而付出的巨大努力是
🔗 原始来源
如果你要核对细节,可以再看原文: TechCrunch AI原文链接
AI热榜