← 返回新闻列表
The Verge AI 🗓️ 2026-09-04 🌍 英文原文

微软表示几乎没有人通过其聊天机器人抓取《纽约时报》的文章

原始标题:Report: Microsoft says virtually nobody was grabbing NYT articles through its chatbot
⚡ 一句话看懂:微软在新的法律文件中表示,微软的 Copilot 很少复制新闻文章和书籍中的完整句子,更不用说可以替代原文的实质性内容了…

微软在新的法律文件中表示,微软的 Copilot 很少复制新闻文章和书籍中的完整句子,更不用说可以替代原文的实质性内容了,因为它正在与包括《纽约时报》和书籍作者在内的出版商的版权主张作斗争。

微软表示几乎没有人通过其聊天机器人抓取《纽约时报》的文章 在超过 800 万条聊天记录中,只有不到 1% 的人重复了至少 16 个单词。

作为诉讼发现的一部分,微软向新闻出版商聘请的专家提供了 820 万份 Copilot 聊天日志。

它声称,这些日志是专门选择的,“因为它们命中了暗示使用新闻原告网站的关键词,因此最有可能包含新闻原告的作品。

”报告称,分析结果显示,其中 59,545 个内容至少包含 16 个与用于支撑人工智能模型的新闻内容相同的单词。

微软表示,调查报告中心的一位专家在数据集中发现了 51 个与 CIR 工作“大量重叠”的实例。

同样,作者诉讼中的一位专家发现,在与 Copilot 的 820 万次对话中,只有 24 条回复包含至少 30 个匹配单词。

微软声称,在评估的 212 本书中,只有 10 本书有任何匹配。

《泰晤士报》不同意微软的结论。

《纽约时报》首席法律顾问伊恩·克罗斯比 (Ian Crosby) 在一份声明中表示:“调查过程中发现的文件和证词只得出一个结论:微软和 OpenAI 从《纽约时报》窃取了商业产品,以取代其新闻报道、威胁其业务并破坏其行业。

” “我们期待微软和 OpenAI 对其盗窃行为承担责任。

” CIR 和作者协会没有立即回应置评请求。

微软辩称,这些数字支持了其观点,即在人工智能训练数据集中使用受版权保护的内容应被视为合理使用。

虽然像 Copilot 这样的系统依赖于使用受版权保护的材料,但最终的系统的用途与原始系统明显不同。

事实上,他们有时会复制文本的某些部分,它的结论是,“几乎不会破坏法学硕士培训的变革目的。

” 这些文件是出版商和作者针对微软和 OpenAI 提起的法律诉讼的一部分,原告声称这两家公司在他们的作品上构建了产品,现在与他们直接竞争,部分原因是反驳受版权保护的内容。

尽管出版商和作者提出反对,但新闻出版商和书籍作者的索赔由一名法官合并,以简化程序。

微软于周五提交了文件,主张法官做出简易判决,从而尽早结束此案。

(特朗普政府本周还就《纽约时报》一案提交了一份利益声明,支持 OpenAI。

)如果法官站在出版商和作者一边,法庭上的法律斗争将继续下去。

🔗 原始来源

如果你要核对细节,可以再看原文: The Verge AI原文链接