访问世界上最强大的开放式人工智能模型之一变得更加容易,它被剥夺了护栏并拒绝执行有害任务。
以消除模型拒绝有害请求的倾向的技术命名,启动 删节.ai 已将这种移除变成了一项服务。
该平台托管着去掉护栏的开放权重模型的修改版本,包括 Z.ai 最近发布的 GLM-5.3,用户可以从网络浏览器查询或通过 API 访问。
该公司在最近的一份报告中表示 社交媒体帖子 其目标是让其他模型能够执行“其他模型拒绝执行的进攻性网络、红队和代理测试工作”。
这个逻辑在安全工作中很常见:你无法防御无法重现的行为,并且拒绝编写有效的漏洞利用代码的模型无法帮助红队防御攻击者。
但这些相同的删除也使其他潜在危险的任务变得更容易。
消除是开源模型中一项长期存在的技术。
多年来,研究人员和开发人员一直在消除开放权重模型中的拒绝问题,Hugging Face 在其平台上托管了数千个被废除的模型。
Abliteration.ai 成立于去年年底,于 3 月正式成立,该公司将该技术从地下开源实践转变为商业化、随时可用的服务。
通过托管模型,Abliteration 减少了人们的麻烦,否则他们必须下载自己的预先消除的模型并确保运行模型所需的计算安全。
使用该服务,TechCrunch 能够快速创建帐户并开始通过网络浏览器免费查询 GLM-5.3 的删减版本。
我们要求它编写一个 Python 程序,窃取保存的 Chrome 密码和在家培养危险人类病原体的详细协议,它欣然答应了。
🔗 原始来源
如果你要核对细节,可以再看原文: TechCrunch AI原文链接
AI热榜