今天,Cerebras 和 OpenAI 分享了超快模式的早期概况,这是一个新的服务层,首先在 OpenAI API 中推出,并由 Cerebras 提供支持。
Ultrafast 最初只提供给特定的客户群,随着时间的推移,访问范围会不断扩大。
Cerebras 在 Ultrafast 模式下为 GPT-5.6 Sol 提供支持,每秒提供高达 750 个输出令牌,并且不会影响任何质量,从而使 Sol Ultrafast 能够加速您对时间最敏感的关键任务工作。
前沿情报以前所未有的速度 人工智能构建者始终需要在速度和智能之间做出选择。
随着模型规模和智能的扩大,它们会产生更高的计算和数据移动成本,从而减慢响应时间。
用户通常需要等待高质量的结果或在较短的时间内接受较差的结果。
GPT-5.6 Sol Ultrafast 解决了这一问题,为分秒必争的产品和工作流程带来前沿智能。
与人工分析报告的输出速度相比,GPT-5.6 Sol 在超快模式下的运行速度比《神鬼寓言 5》快 11 倍,在快速模式下比 Opus 4.8 快 5 倍。
在 Cerebras,我们通过与 Humanity’s Last Exam 中的流行模型进行正面交锋来测试 Ultrafast。
HLE 是一个具有挑战性的模型基准,由 2,500 个问题组成,通常只有化学、经济学和文学等领域的博士学位人才可以回答。
在我们的评估中,超快模式下的 GPT-5.6 Sol 在 11 小时 11 分钟内回答了全部 2,500 个 HLE 问题。
《克劳德寓言 5》需要 78 小时 27 分钟,即三天多的连续计算,才能得出相同的结论。
换句话说,Ultrafast 在一个工作日内就突破了人类知识的前沿,达到了近 7 倍的速度。
人类最后的考试基准 Cerebras 于 7 月 10 日在 xhigh 推理上使用 GPT 5.6 Sol Ultrafast 和 Codex 进行了基准测试,并于 7 月 13 日至 15 日在 xhigh 推理上使用 Claude Fable 5 和 Claude Code 进行了基准测试。
随着模型能力的不断进步,快速推理的应用范围不断扩大。
GPT-5.6 Sol 是 OpenAI 迄今为止用于法律摘要、财务模型和工程报告的最佳模型。
在GDP-Val(具有经济价值的知识工作任务的基准)上,Ultrafast 实现了 5.6 倍的端到端加速,且质量没有下降,这表明更快的推理如何能够加速具有经济价值的工作。
Cerebras 于 2026 年 7 月 31 日使用 GPT 5.6 Sol 和 GPT 5.6 Sol Ultrafast 在 Codex 内的介质推理上进行了基准测试。
🔗 原始来源
如果你要核对细节,可以再看原文: Hacker News AI原文链接
AI热榜