DeepSeek发布V4.1 Flash并调整旗舰模型服务
杭州深度求索人工智能基础技术研究有限公司(DeepSeek)于2026年9月10日正式发布了DeepSeek-V4.1-Flash模型。该模型被定位为新架构家族中最小的模型,目前已在Web端、移动端及官方API上线,且其模型权重在MIT许可下发布。
核心技术进展与性能表现
V4.1 Flash采用了新型的因果编码器-解码器(causal encoder-decoder)架构。在参数规模方面,该模型为混合专家(MoE)模型,中心模型网络包含5520亿个参数,约为前代V4 Flash(2840亿参数)的两倍。在处理提示词时,该架构仅保持80亿参数处于激活状态,而在处理过程中则为160亿参数。
在功能特性上,V4.1 Flash在维持100万token上下文窗口的同时,实现了对图像的原生处理能力,而此前的V4 Pro和V4 Flash并不具备此项功能。
关于性能表现,DeepSeek表示多方测试显示该模型在性能、成本、速度和总运行时间上均领先于原旗舰模型V4-Pro。此外,有报道指出V4.1 Flash在Artificial Analysis Intelligence Index上的得分为40,超越了参数量为1.6万亿的V4 Pro 0813,且每token成本约为后者的四分之一。
服务调整与后续安排
随着V4.1 Flash的推出,DeepSeek对现有模型服务进行了调整:
- V4-Pro服务重定向:自2026年9月14日起,所有通过API发送至旗舰模型V4-Pro的请求将全部重定向至V4.1 Flash。在V4.1 Pro版本发布之前,V4.1 Flash将承担旗舰模型的角色。
- 计费变更:重定向后的请求将按照V4.1 Flash的费率进行计费。
- 旧模型退役:V4 Flash以及8月发布的实验性视觉模型均已退役。目前,发送至这些旧模型的请求也将由V4.1 Flash提供服务,并按Flash定价计费。
DeepSeek表示,V4.1 Flash的设计旨在提供更高的能力上限、更快的推理速度和更高的吞吐量,并为同一家族中更大规模模型的扩展预留空间。
评论区
已通过 0 条 · 审核通过后展示