Qwen3.8-27B模型概述与核心能力

Qwen3.8-27B是由阿里巴巴千问团队于2026年8月14日开源的27B Dense原生多模态大模型。该模型基于Qwen3.5的架构基础,是目前Qwen开源家族中综合能力最强的27B级稠密模型。作为原生视觉-语言模型(Vision-Language Model),它采用“因果语言模型 + 视觉编码器”结构,参数规模约270亿,能够同时处理纯文本以及图片与视频内容。

在技术参数方面,Qwen3.8-27B的上下文长度为262,144 tokens,最高可扩展至1,000,000 tokens。该模型默认开启思考模式,并支持通过reasoning_effort参数调节推理深度(low/medium/xhigh),同时默认启用preserve_thinking以保留历史推理上下文,这对长对话场景的智能体任务具有重要意义。

性能表现与行业评价

官方评测数据显示,Qwen3.8-27B在主流智能体编程基准上较Qwen3.6-27B有显著提升。具体表现为:在JobBench上从21.8提升至33.4(提升53%),在QwenSWEBench上从49.3提升至79.0(提升60%),在DeepSWE 1.1上从13.3提升至42.2(提升217%),此外在Terminal Bench 2.1、SWE-bench Pro、NL2Repo-Bench和CoWorkBench等基准测试中也分别实现了15%、15%、17%和16%的提升。

由于其强大的性能,Qwen3.8-27B在8月10日开源后两天内登顶Hugging Face趋势榜,并进入史上最受欢迎模型榜第三名,下载量超过100万次。业内将其视为“开源模型的新一代斩杀线”。

部署应用与实测情况

Qwen3.8-27B兼容Transformers、vLLM、SGLang等主流推理框架。在实际应用中,用户可通过vLLM引擎进行本地私有化部署,将代码补全、重构、文档生成等任务交给本地模型,以节省Token成本并获得接近收费模型的编程能力。

在硬件适配实测中,有用户在配备32GB统一内存的M5 MacBook Air(无风扇)上运行该模型。测试结果显示,在32K上下文及单请求条件下,短测最高速度可达20.6 tok/s,纯电池运行完整benchmark时可稳定在17.6至18.3 tok/s,日常使用Pi Agent进行工作时速度约为13至16 tok/s。

阿里巴巴AI矩阵背景

Qwen3.8-27B是阿里全模态矩阵的一部分。根据2026年8月20日发布的财报,阿里云AI云及算力服务收入达484.37亿元,同比增长133%。目前,阿里在大语言模型(Qwen3.8-Max)、图像模型(Qwen-Image-3.0)、语音模型(Qwen-Audio)、视频模型(Wan3.0)及音乐模型(HappyShrimp)等多个方向均已进入全球第一梯队。