← 返回新闻列表
TechCrunch AI 🗓️ 2026-09-17 🌍 英文原文

新的未经编辑的文件显示,微软高管称人工智能窃取“人类历史上最大的劳动力盗窃行为”

原始标题:In depth: Microsoft exec called AI scraping ‘the largest theft of labor in human history,’ new unredacted filings reveal
⚡ 一句话看懂:最新公开的法庭文件显示,微软私下称 OpenAI 的数据行为为“盗窃”,而两家公司则抓取了《纽约时报》的付费内容,从中构…

三年前,《纽约时报》对 OpenAI 和微软提起的版权诉讼中未经编辑的新信息显示,它承认人工智能抓取等同于盗窃,并且人工智能产品对出版物构成了重大威胁。

根据诉讼,微软的一位高管私下将公司的人工智能培训实践描述为“盗窃”,而 OpenAI 自己的领导层表示,其人工智能模型对接受培训的出版商和记者构成了“生存威胁”。

未密封的材料还详细介绍了据称这些公司如何通过绕过未被发现的付费墙、通过大规模抓取构建训练数据集以及故意从训练数据中删除版权声明来获取和使用该内容。

值得注意的是,许多新信息来自《纽约时报》自己的简报,而不是仍然密封的基本证据。

下面的引用没有其原始上下文。

这份未经编辑的文件是这场长达三年的诉讼的最新升级,《纽约时报》最初指控这些公司根据其内容训练生成人工智能模型,违反了版权法。

人工智能公司是否可以合法地使用受版权保护的材料来训练人工智能的问题还没有明确的答案,但法官们基本上支持人工智能公司关于培训构成“合理使用”的论点。

这项法律规则允许人们在某些情况下未经许可使用受版权保护的作品,例如模仿、新闻报道或批评。

本月早些时候,特朗普政府提交了一份简报,为 OpenAI 未经许可使用受版权保护的材料来培训法学硕士进行辩护。

然而,一些新的承认与 OpenAI 的合理使用辩护背道而驰,特别是该规则要求使用不能替代或损害原始作品的市场。

例如,微软自己的数据显示,与传统的 Bing 搜索相比,其 Copilot“答案引擎”导致《纽约时报》域名的点击率下降了 93%。

微软应用科学总监 Brent Hecht 在 2024 年 1 月撰写的微软内部演示文稿中将这种下降描述为“厄运循环”,它将“同时损害我们模型和整个网络的性能”。

文件中引用的微软文件中写道:“最终产品威胁其主要供应商的经济基础是非常不寻常的,但这就是我们为法学硕士业务在‘内容供应链’方面创造的情况。

” 微软首席执行官萨提亚·纳德拉 (Satya Nadella) 在今年早些时候的一份证词中也表示,“任何付费的东西都应该获得任何想要使用它的人的许可……用于基础或培训”,并明确表示,如果他“意识到 OpenAI 已经抓取了付费墙背后的信息并进行了培训”,他就会“援引[微软的权利]要求 OpenAI 重新训练其模型。

🔗 原始来源

如果你要核对细节,可以再看原文: TechCrunch AI原文链接