DeepSeek V4 Flash上线及其市场影响
7月31日,DeepSeek V4 Flash正式版上线。该版本在保持模型架构与规模不变的情况下,通过重新进行后训练,重点加强了编码、Agent及工具调用能力。根据第三方评测机构Artificial Analysis的数据,DeepSeek V4 Flash 0731的智能指数为49.9277(或50分),在同类101款模型中排名第三,推理速度达每秒113.5个Token,上下文长度支持100万Token。
在定价方面,DeepSeek V4 Flash每百万Token缓存未命中的输出价格为2元人民币,缓存命中时的输入价格为0.02元。相比之下,Anthropic的Claude Opus 4.8标准输出单价约为170元(25美元),两者相差约85倍。
“斩杀线”的定义与行业格局变化
由于性能与价格的平衡,DeepSeek在开发者市场中划出了一条“斩杀线(Kill Line)”。这条线被定义为性能与价格的平衡临界值:在同一能力梯队中,定价显著高于DeepSeek的模型将持续流失开发者;而性能弱于其且成本更高的产品,生存空间将快速萎缩。
这种格局导致大模型调用市场出现分化:大型跨国企业因数据合规和供应链风险仍采购OpenAI、谷歌等服务;但中小开发者群体正大规模迁移至DeepSeek-V4-Flash,其月度推理成本因此下降60%至85%。
调用量数据与生态趋势
OpenRouter最新周级数据显示,DeepSeek-V4-Flash在平台单模型调用量中排名第一,随后依次为小米MiMo-V2.5、腾讯Hy3、DeepSeek V4 Pro和智谱GLM5.2。国产模型总调用规模已连续多周超越美国厂商闭源模型总和,其中美国和欧洲开发者占比接近半数。
此外,开源AI Agent工具OpenCode发文称,DeepSeek V4 Flash在单日内通过其平台消耗了8万亿Token,其中5万亿来自免费额度,3万亿来自付费套餐OpenCode Go。OpenCode CEO Jay表示,该模型上线后,其使用量及OpenCode Go新订阅用户单日均增长了30%。
彭博社指出,包括DeepSeek、月之暗面Kimi K3、阿里千问Qwen3.8-Max、字节跳动Seedance2.5和智谱AI GLM-5.2在内的5款重要模型在八周内相继发布,显示出中国已形成一套可持续推出接近全球前沿水平模型的体系。
评论区
已通过 0 条 · 审核通过后展示