核心技术规格与架构

2026年8月3日,阿里云千问团队发布旗舰模型Qwen3.8-Max。该模型总参数量达到2.4万亿,是目前千问系列中规模最大的模型。在技术架构上,Qwen3.8-Max基于Qwen 3.5架构演进,采用了稀疏混合专家(MoE)架构与混合注意力机制的组合方案。在这种设计下,模型在单次推理时仅激活约950亿参数,其余专家模块处于待命状态。

在能力支持方面,Qwen3.8-Max支持最高100万token的上下文窗口,并原生支持视觉理解,属于多模态基座模型。这意味着该模型可直接输入超过100小时的直播视频或200页的财报PDF,并将其转化为可检索的结构化知识。

评测表现与性能对比

根据权威众包榜单Arena的结果,Qwen3.8-Max在Vision Arena排名全球第二(仅次于Claude系列),在Text Arena排名全球第五,在Frontend Code Arena中排名第四。在细分专业评测中,该模型在OSWorld-Verified电脑操作能力评测中得分86.1,位居主流模型首位;在科研复现评测PaperBench中得分93.0,创下评测新高;此外,其在GPQA Diamond科学推理得分92.6,IF Bench指令遵循得分82.8。

在与DeepSeek V4 Flash的对比中,AA Intelligence Index v4.1显示Qwen 3.8 Max得分为53,高于后者的50。Arena文本榜Elo值方面,Qwen领先60分。但在成本与效率上,实测显示Qwen 3.8 Max在特定任务的费用是DeepSeek V4 Flash的345倍,耗时为后者的6倍。

商业模式与开源计划

阿里宣布Qwen3.8-Max的模型权重将在下周开源。这是Max级别旗舰模型首次面向公众开放源代码。在成本控制方面,该模型每百万输出Token的推理成本约为6美元,低于行业主流标杆模型的50美元水平。为了实现这一优化,团队依托自研AI芯片与通用处理器等硬件资源,构建了覆盖芯片、软件与系统级的协同算力体系。

行业分析认为,通过开源权重、定价策略和自研芯片,阿里正试图改变大模型的商业模式,使企业客户能够在租用闭源API与部署同体量开源模型之间做出选择。