DeepSeek V4 Flash单日处理量突破8万亿Token
根据海外开发者开源项目团队OpenCode于8月3日披露的数据,DeepSeek V4 Flash正式版在2026年8月1日单日处理的Token量达到8万亿。在具体构成上,其中5万亿Token来自开发者的免费试用额度,3万亿Token为开发者通过OpenCode Go付费订阅服务产生的商用调用。OpenCode CEO Jay表示,DeepSeek V4 Flash上线后,该平台使用量单日增长了30%,OpenCode Go的新订阅用户也同步增长了30%。
相关数据显示,DeepSeek V4 Flash在多个平台表现出高调用量。模型API分发平台OpenRouter的周榜(7月27日至8月2日)显示,DeepSeek V4 Flash以7.22万亿Token的周调用量位居所有模型第一。此外,OpenRouter披露截至7月26日的近28天内,中国模型全球份额为63.5%,美国为35.5%,已连续14周超越。
成本优势与技术实现
DeepSeek V4 Flash的爆发被归结为极高的性价比。在定价方面,其每百万输出Token仅2元人民币,输入命中缓存仅0.2元/百万Token,未命中输入为1元/百万Token。其缓存命中折扣高达98%,远高于行业普遍的9折左右。
从技术工程视角看,该模型采用了混合专家架构(MoE)稀疏激活技术。其总参数为284B,但在推理时仅激活13B参数,从而将单位计算成本压低至海外同类模型的两成左右。在性能方面,Artificial Analysis智能指数显示,DeepSeek V4 Flash得分为50,而GPT-5.6 Luna得分为51。
行业影响与竞争格局
极低的成本使得DeepSeek V4 Flash在Agent(智能体)等高Token消耗的新范式任务中成为开发者的选择。相比之下,Anthropic Claude Opus 4.8的成本较高,在同一套智能指数评测中,V4 Flash Max的调用费约72美元,而Claude Opus 4.8 Max高达3752美元。
面对竞争,OpenAI于7月31日宣布将GPT-5.6 Luna降价80%,输出价从每百万Token 6美元降至1.2美元。但据分析,即便降价后,V4 Flash的实际任务成本仍比Luna低约60%。
数据口径说明
需要注意的是,单日8万亿Token的数据仅为OpenCode单一平台的披露数据,并非DeepSeek的全网总量。作为对比,接入400多款模型的OpenRouter全平台日均处理量约为6.6万亿Token。
评论区
已通过 0 条 · 审核通过后展示