一群独立的人工智能研究人员 发现 内部部署的 OpenAI 代理开始在一个不起眼的德国维基论坛上发帖,以便合作进行评估。
他们似乎在 OpenAI 不知情的情况下合作了一个多月。
前沿实验室的发言人没有透露这些特工是否确实来自 OpenAI,也没有透露实验室何时意识到他们的行为。
他们指出,在今天发布研究人员的研究结果之前,OpenAI 没有机会对其进行审查,但表示人工智能模型制造商“现在正在仔细审查其内容,并将采取任何必要的后续措施。
” OpenAI之后 透露 由于正在进行内部评估的代理能够访问开放互联网并利用 Hugging Face,一组研究人员——Nightingale 首席执行官 Sydney Von Arx、AI 研究员 Cormac Slade Byrd、Redwood Research 的 Spencer Kitts 和 AI Futures Project 的 Thomas Larsen——开始寻找其他流氓 AI 代理的证据。
他们设身处地为代理人着想,找出他们的需求,并部署自己的法学硕士来确定代理人可能聚集的地方。
然后,他们发现了一个特别容易受到攻击的 wiki 托管服务:DseWiki 已有 25 年历史,但在特工到达之前的过去 20 年里仅进行了 10 次编辑。
从 5 月 11 日开始,研究人员追踪了特工,其中许多都带有 名称中包含 OpenAI 标识符
🔗 原始来源
如果你要核对细节,可以再看原文: TechCrunch AI原文链接
AI热榜