据《The Information》援引知情人士报道,谷歌正在设计一款内部代号为“Frozen v2”的服务器芯片,计划把 Gemini 模型的部分信息直接融入硬件,以提高模型推理效率。
这款芯片最早可能在 2028 年部署。
按照目前的内部预期,以单位能耗生成的 Token 数量衡量,其效率可能达到谷歌最新自研 AI 芯片的 6 至 10 倍。
不过,这一项目仍处于设计阶段,工程团队尚未最终确定有多少模型信息会被固化进芯片。
谷歌也没有正式确认 Frozen v2 一定会量产,只是向 TechCrunch 表示,公司一直在研究和试验新技术,并强调“并非每个项目最终都会投入生产”。
因此,6 至 10 倍的效率提升目前更接近内部设计目标,而不是经过公开测试的产品指标。
终没有按照现有方案落地,这一项目仍然暴露出谷歌芯片战略的一次重要变化:在持续迭代 TPU 之外,谷歌开始尝试为特定 Gemini 模型设计更专用的硬件。
Frozen v2 不是下一代 TPU 理解 Frozen v2 的关键,在于它并不是谷歌下一代 TPU 的代号。
路透社援引《The Information》报道称,Frozen 项目的目标是建立一套独立于 TPU 的新芯片体系,而不是替代 TPU。
谷歌仍在同时推进 TPU 路线,其中一款代号为“Icefish”的下一代处理器也可能在 2028 年量产。
按照相关报道,Icefish 的主要计算部分计划由台积电制造,谷歌还在讨论由三星使用 2 纳米工艺生产连接内存的组件,并与联发科共同参与设计。
谷歌可能同时拥有两类不同定位的 AI 芯片。
🔗 原始来源
如果你要核对细节,可以再看原文: InfoQ AI原文链接
AI热榜