← 返回新闻列表
量子位 🗓️ 2026-08-28

智谱 GLM-5.3-Flash上线,商汤大装置提供国产算力支持,这意味着什么?

⚡ 一句话看懂:国产异构助力前沿智能进入普惠时代

智谱 GLM-5.3-Flash上线,商汤大装置提供国产算力支持 量子位的朋友们 2026-08-28 12:06:16 来源: 量子位 8月26日晚,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列的首个原生多模态模型。

其总参数320B,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。

GLM-5.3-Flash的架构专为极低成本而设计,结合智谱最新的30T Token多模态预训练语料,能够以更少的计算资源实现更强的性能。

依托先进的国产异构混推技术,商汤大装置为GLM-5.3-Flash上线提供大规模国产算力支持与Token服务,打造国产算力规模化商用又一硬核落地标杆。

这一合作的背后,正是商汤打造的 “一套模型、一座 Token(词元)工厂、一套智能体管控系统” 核心能力体系。

其中 Token 工厂承担着把智能能力规模化生产出来的关键作用:它通过多模态模型和大装置基础设施的联合优化,把不同芯片、集群、能源和交付节点组织起来,持续生产更高质量、成本更低的Token。

同时Token工厂与大模型之间构建起双向反哺闭环,更好适配原生多模态模型的迭代需求。

商汤大装置高效支持了智谱 GLM-5.3-Flash的上线工作,正是这套闭环能力的有力印证。

长期以来,市场对国产算力的认知是,性价比不高、难以规模商用。

而在正式发布前,GLM-5.3-Flash以匿名模型Ox-Alpha(中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试,Token调用量高达62T,

🔗 原始来源

如果你要核对细节,可以再看原文: 量子位原文链接