← 返回新闻列表
InfoQ AI 🗓️ 2026-08-03

阿里Qwen3.8正式发布:2.4T规模,自主编程16天搓出一个Hermes Agent,业内人士怎么看?

⚡ 一句话看懂:阿里Qwen3.8正式发布:2.4T规模,自主编程16天搓出一个Hermes Agent,业内人士怎么看?。来源:InfoQ AI。

阿里 Qwen3.8 正式发布,2.4T 规模,自主编程 16 天搓出另一个“Hermes Agent”!

8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。

今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。

目前,Qwen3.8 的 API 已上线千问 AI 平台,并接入阿里今日同步推出的 Agent 产品“千问办公”。

Qwen3.8-Max 预计下周开源,同时还将开源 Qwen3.8-27B。

今日起,全球开发者都可通过千问 AI 平台获得 Qwen3.8 的 API 服务,国内每百万 Tokens 输入 12 元、输出 36 元,隐式缓存命中仅 1.5 元,而输入与输出的国际价格仅分别为 Opus5 的 40%与 24%,实现相近智能更高性价比。

同时,阿里旗下企业级 Agent 产品“千问办公”(QwenWork)开启公测。

个人和企业用户均可通过“千问办公”官网(qwenwork.cn)体验,目前网页版和独立 PC 客户端已开放,钉钉 PC 端和手机端内置入口近期也将开放。

用户可在“千问办公”体验阿里最新旗舰模型 Qwen3.8。

2.4T 大模型,“Qwen3.8 就像个资深的工程师” 此次发布的是千问大模型系列中尺寸最大、性能最强的旗舰模型 Qwen3.8-Max,它支持视觉理解,上下文长度达 1M Tokens。

在模型架构上,Qwen3.8 通过稀疏 MoE 架构与混合注意力机制的联合优化,首次将千问大模型的总参数量拓展至 2.4T,激活 95B,获得了更高的推理效率、更快的推理速度,整体性能也迎来新突破:

  • 在科研复现评测 PaperBench 等编程智能体评测中,Qwen3.8-Max 较上代模型大幅提升 28.2 分,以 93.0 分录得评测新高;

  • 在 WideSearch、Agent’s Last Exam 等通用智能体评测中,新模型分别取得 81.9 分和 52.4 分,位居前沿。

  • 同时,Qwen3.8 在指令遵循 IF Bench 评测中斩获 82.8 分,科学推理 GPQA Diamond 取得 92.6 分,系列通用能力均位居前列;

🔗 原始来源

如果你要核对细节,可以再看原文: InfoQ AI原文链接