← 返回新闻列表
The Verge AI 🗓️ 2026-09-10 🌍 英文原文

数学家想要证明 OpenAI 没有使用他们的工作成果

原始标题:Report: Mathematicians want proof OpenAI didn’t use their work
⚡ 一句话看懂:另一位研究人员正在就数据驱动 OpenAI 不断取得令人印象深刻的数学发现向 OpenAI 发起挑战。就在围绕该公司的模…

另一位研究人员正在就数据驱动 OpenAI 不断取得令人印象深刻的数学发现向 OpenAI 发起挑战。

就在围绕该公司的模型是否受益于未发表的工作而引发激烈争论的几天后,第二位数学家站出来指责这家人工智能巨头的不道德和“不诚实”行为,以及其训练数据的来源缺乏透明度。

数学家想要证明 OpenAI 没有使用他们的工作成果 另一位数学家在取得几项重大突破后指责该公司“不诚实”。

在 Mastodon 的一系列帖子中,数学家 Andreas Thom 表示担心,在 OpenAI 成功宣布之前,他和他的同事与 ChatGPT 聊天机器人的互动可能有助于其在该领域的成功。

OpenAI 上个月大张旗鼓地宣布了 10 项成果,其中一项涉及 Thom 的专业领域,即所谓的非 sofic 团体,OpenAI 承认他们的成果在很大程度上建立在 Thom 和数学家加博尔·昆 (Gábor Kun) 之前的工作基础上。

Thom 表示,在纽约大学数学教授 Tristan Buckmaster 公开质疑该公司的 AI 模型是否因他使用 OpenAI Codex 而受益之后,他开始反思自己与 OpenAI 的互动。

OpenAI 公布其非 sof 团体结果后,因未能承认 Thom 和 Kun 最近的贡献而受到数学界的广泛批评,该公司悄悄修改了其报告。

粗略地说,非实体群是无限的数学结构,不能用有限的数学结构来近似。

Thom 表示,“OpenAI 对我们技术的详细掌握”也让他感到震惊,他说这在当时既不是最明显也不是最有希望的解决方案。

他说,他给 OpenAI 研究人员 Sébastien Bubeck 和哈佛大学统计学家 Mark Sellke 写了电子邮件,询问他与 ChatGPT 的交互是否是“训练数据的一部分或可用于推理过程”,因此可能对结果有所贡献。

但答案并没有让 Thom 满意,他表示,这只是解决了他与聊天机器人的对话是否可以直接访问,而不是他们是否已进入该公司用于改进模型的庞大训练数据池。

“没有给出这样的资格、解释或证据,”他写道。

“至少可以说,我认为这是不诚实的。

” Thom 表示,研究人员没有能力对 OpenAI 的训练流程进行逆向工程,以确定他们的工作是否已被使用。

“只有 OpenAI 拥有这方面的相关数据。

”他表示,如果该公司否认这样做,他们就有责任通过披露所有必要的数据集并澄清各种设置和条款来证明其如何使用数据。

OpenAI 不愿最终排除对用户数据的任何使用,这与它捍卫其最近的千禧年奖突破的方式相呼应,无论是在其公共信息还是与巴克马斯特的沟通中——巴克马斯特正在以个人身份与人类研究员 Levent Alpöge 一起研究问题。

在宣布涉及流体运动的纳维-斯托克斯解决方案的博客文章中,OpenAI 断然否认使用任何特定的用户数据:“在他们公开发布之前,我们(研究人员和代理人)没有通过任何方式看到他们的任何工作 - 特别是,没有访问任何特定的用户数据来解决这个问题。

” 但这并不能最终排除间接影响:“虽然不太可能,但我们不能排除从他们使用我们产品时获得的去识别化数据有助于改进我们的模型。

”汤姆表示,该公司在与他的沟通中也采用了同样令人困惑的区别。

“去识别化可能会删除一个名字;它不会删除数学思想的知识内容,”他说。

🔗 原始来源

如果你要核对细节,可以再看原文: The Verge AI原文链接