DeepSeek V4-Flash正式版上线公测

2026年7月31日,DeepSeek在API文档更新日志中宣布,DeepSeek-V4-Flash正式版API开启公测,模型版本号为V4-Flash-0731。开发者可通过原有的“deepseek-v4-flash”名称进行调用,无需更换接口。此次更新仅限于API,DeepSeek App、网页端以及V4-Pro API均未做更改。官方表示,V4-Pro正式版将“尽快发布”,预计在8月初上线。

模型特性与能力提升

在模型规格方面,V4-Flash-0731的结构、尺寸与4月发布的预览版完全一致,采用284B总参数、13B激活的MoE架构,并支持1M超长上下文。DeepSeek指出,此次升级并非通过增加参数,而是仅重新进行了后训练(post-training)及Agent框架优化。

此次更新重点改善了代码修改、工具调用和多步骤任务执行等Agent能力。官方公布的数据显示,V4-Flash-0731在九项智能体、代码和自动化基准测试中的整体表现显著高于V4-Pro预览版。具体评测得分包括:

  • Terminal Bench 2.1得分为82.7;
  • DeepSWE得分为54.4,较预览版的7.3提升了7.5倍;
  • Cybergym得分为76.7;
  • Toolathlon verified得分为70.3;
  • DSBench-FullStack得分为68.7,DSBench-Hard得分为59.6

此外,海外评测机构Artificial Analysis在7月31日的智能指数测试中给予该模型50分,高于同类可比模型17分的中位数,但其生成Token量(2.1亿个)明显高于中位数(6200万个)。

生态适配与成本优势

在接口支持方面,DeepSeek首次原生支持Responses API,并针对Codex进行了适配。Responses API是OpenAI用于统一处理模型输出、推理过程和工具调用的接口格式。得益于此,开发者可在Codex CLI、ChatGPT桌面端和VS Code的Codex插件中将DeepSeek配置为模型提供方。目前Responses API仅支持V4-Flash,V4-Pro预计8月初接入。

在成本方面,V4-Flash-0731延续了高竞争力定价,输入每百万token的价格为0.14美元(约14美分),另有资料提及价格为¥1/百万token。