← 返回新闻列表
TechCrunch AI 🗓️ 2026-09-17 🌍 英文原文

Base Labs 与 Hugging Face 和 Goodfire 建立开放式人工智能安全合作伙伴关系

原始标题:Latest: Base Labs launches an open-weight AI safety partnership with Hugging Face and Goodfire
⚡ 一句话看懂:BaseLabs 是 Baseten 今年早些时候成立的研究小组,将开发和发布用于训练和监控开放模型的方法

巴斯坦 周三,其 Base Labs 研究部门推出了新的安全基础设施标准,与 Hugging Face 和 Goodfire AI 合作,为开放权重模型构建安全评估和监控基础设施。

这一声明正值关于开放权重模型安全性的争论中——通过一种名为“开放权重模型”的新兴技术消除其保护措施,可能会变得危险。

删节 。

这个问题的规模是巨大的:托管开源 AI 模型的 Hugging Face 目前列出了 6,000 多个被废除的模型。

BaseLabs 是 Baseten 今年早些时候成立的研究小组,将开发和发布用于训练和监控开放模型的方法。

该公司正在将他们未来的工作构建为开放模型的“标准”,该标准是透明的,并内置于模型的训练和部署方式中,而不是事后附加。

该公司表示:“我们相信开放性是人工智能安全的一个优势。

” X 。

“开放性提供了对模型行为的更多可见性,最重要的是,与闭源相比,开放性提供了将安全研究转化为可操作且透明的控制的更好方法。

” 两家公司尚未透露合作伙伴关系将如何在技术上运作,尽管 Goodfire 在回复 Baseten 的帖子中阐述了这一目标:“安全必须内置于开放模型中,并由为它们服务的人提供。

” Goodfire 专门打开人工智能的“黑匣子”来解释模型如何做出决策,是“内置”部分最有可能的候选者。

🔗 原始来源

如果你要核对细节,可以再看原文: TechCrunch AI原文链接