V4.1 Flash模型发布计划

9月9日,DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式推出V4.1 Flash模型。

根据官方披露,经内部及多方测试验证,V4.1 Flash在性能表现、响应速度、使用成本和总处理耗时等多个关键维度上均已达到或超过当前V4 Pro的水准,实现了全面的代际跨越。

技术升级与架构特性

在技术层面,V4.1 Flash的升级并非简单的参数堆叠。

  • 模型结构:据DeepSeek在官方交流群中透露,V4.1 Flash的中间版本采用了全新的模型结构。
  • 功能支持:新模型原生支持多模态任务处理。
  • 性能提升:新架构在保持高推理效率的同时拓展了应用边界,使模型能力更强,响应速度明显提升,且整体成本进一步下降。

定价方案调整

DeepSeek宣布将从2026年9月10日12时起执行Flash系列的新价格方案:

  • 空闲时段:输入缓存命中每百万Token价格为0.02元,输入缓存未命中每百万Token价格为1元,输出每百万Token价格为4元。
  • 高峰时段:各项价格均为上述空闲时段价格的两倍。

模型切换过渡安排

针对新旧模型的切换,DeepSeek承诺在V4.1 Flash正式上线之后、V4.1 Pro上线之前,平台会将所有V4 Pro的请求自动路由到V4.1 Flash。

在上述过渡期间,相关请求将按V4.1 Flash的单价计费。官方表示,此举旨在保证服务的连续性,并让用户在过渡期以更低成本享受到更优性能。