我 就直接说吧:AI“推理”到底是怎么回事?
抱歉,空气报价。
这种标点符号的侧视在 2024 年更为常见,当时经过专门训练的法学硕士近亲(现在被称为“大型推理模型”或 LRM)仍然是新生事物。
不过,考虑到 OpenAI 的“通用推理模型”在 2026 年 5 月一次性解决了一个著名的开放数学研究问题,现在看来这似乎是彻头彻尾的无礼。
尽管如此,我不知道如何才能承认我对这些人工智能系统实际行为的科学解释的智力上的鞭笞。
推理进来了 许多技术上定义的形式 ,但基本过程很容易识别:通过将逻辑上相互遵循的中间步骤链接在一起,得出合理的结论。
我们用思想来做到这一点; LRM 使用所谓的思想链,这是一个术语,指模型在得出复杂查询的答案之前发出的合成文本流。
前一分钟,人工智能可以通过这些链条进行推理的想法(来自苹果公司的一组研究人员)受到了显着且可信的批评,称其为“ 思维的错觉 在极其简单的条件下,“精度完全崩溃”。
下一分钟,LRM 在国际数学奥林匹克竞赛中获得了金牌,这一壮举是如此具有挑战性,以至于“即使是非常成功的数学家和科学家也可能会在他们的简历中终生强调它”,正如科学家和人工智能评论家加里·马库斯和欧内斯特·戴维斯所说 写道 2025 年。
如果这不是“真正”推理的标志,那什么才是?
🔗 原始来源
如果你要核对细节,可以再看原文: Hacker News AI原文链接
AI热榜