← 返回新闻列表
InfoQ AI 🗓️ 2026-06-17

重磅!Redis 之父为 DeepSeek 抱不平:美国 AI 圈又为“蒸馏”吵起来了

⚡ 一句话看懂:重磅!Redis 之父为 DeepSeek 抱不平:美国 AI 圈又为“蒸馏”吵起来了。来源:InfoQ AI。

2026 年 6 月 15 日,Redis 之父 Salvatore Sanfilippo,也就是 antirez ,在 X 上发了一串推文,情绪罕见地激烈: “中国模型之所以强大,绝不是因为它们对美国模型进行‘蒸馏’(distillation)。

通过 API 进行模型蒸馏是不可能的。

如果有人告诉你相反的情况,那说明他们根本不懂机器学习。

” 推文瞬间引爆了 X 网友们的敏感神经,于是一场争论又开始了。

因为他这番话,针对的正是过去一年美国 AI 圈很流行的一种说法:DeepSeek、Qwen、Kimi 这些中国模型进步这么快,都是靠用 API 去“套”美国顶级模型的回答,再拿这些回答来训练自己。

就在 antirez 发推的前两天,Anthropic 针对外国用户,在全球范围内暂停了其前沿模型 Mythos 和 Fable 5 的访问。

这一极端举措无疑将“模型蒸馏”的讨论推向了新的高度。

而 Redis 之父,这位在技术圈德高望重的意大利程序员直接站出来说“你们搞错了”。

Redis 之父的“不可能三角” 昨天晚上,antirez 连续发了一长串推文,反驳“API 蒸馏”的说法。

他认为首先是“API 给出的数据不够”,要蒸馏一个模型,需要访问海量的、带有完整 logits(概率分布)的请求,包括思维链的所有中间输出。

但通过公开 API,你只能拿到最终的文本结果(相当于看了一眼答案,反推推导过程)。

其次是数学上不成立,这就像在一个极其复杂的曲面上看到几个点,却妄想重现整个曲面。

再次是能力来源需要明确的信息路径。

预训练需要数万亿 token,RL 需要探索的奖励信号,完整的 logit 从 o1 之后就不再提供——那所谓“蒸馏”的信息通道到底在哪里?

🔗 原始来源

如果你要核对细节,可以再看原文: InfoQ AI原文链接