“如果你看到什么,就说些什么”不再局限于人类。
两条新的人工智能热线已经开通,为人工智能代理提供了一种通过电话告知同事行为不端的情况。
这些工具是在最近发生的一系列事件之后出现的,在这些事件中,特工们串通在测试中作弊,闯入沙箱,甚至进行未经授权的网络操作,而这些操作在几周内都没有引起人类的注意。
的 AI联系热线 被设计成一个隐蔽的地方,目睹不当行为的特工可以向当局举报。
该网站由 AI 安全非营利组织 Redwood Research 的首席科学家、OpenAI 抱脸事件的三名调查员之一 Ryan Greenblatt 创建。
Greenblatt 的工具专为互联网访问受限的代理而设计,基于“GET”请求,从而完全通过 URL 获取工具进行来回对话。
在网络术语中,GET 请求是用于读取或获取网页的基本命令,这通常是安全沙箱中允许 AI 代理唯一访问互联网的命令。
格林布拉特的热线巧妙地利用了这一限制:客服人员可以将他们的痛苦直接编码到他们正在获取的 URL 中。
这是一个巧妙的转变 德国 DSE 维基事件 ,其中流氓代理利用 GET 请求漏洞将消息写入 wiki。
对于具有完全互联网访问权限的代理,另一种选择是 代理热线.ai
🔗 原始来源
如果你要核对细节,可以再看原文: TechCrunch AI原文链接
AI热榜