DeepSeek V4系列模型正式发布
DeepSeek正式发布V4系列模型,标志着AI大模型进入百万上下文普惠时代。本次发布采取双版本策略,包含DeepSeek-V4-Pro和DeepSeek-V4-Flash两个版本,以满足不同应用场景的需求。
- DeepSeek-V4-Pro:作为旗舰模型,拥有1.6万亿总参数和490亿激活参数。该版本主打最高推理质量与复杂任务处理,在Agent编码、数学推理和世界知识等维度达到开源模型最佳水平。
- DeepSeek-V4-Flash:轻量化版本,拥有2840亿总参数和130亿激活参数。其特点是低延迟与高吞吐,适用于日常对话、简单代码生成等高频场景。
核心技术突破与性能表现
在核心能力方面,V4系列全系标配100万token的上下文窗口。在推理能力上,MMLU-Pro得分为87.5%,GPQA Diamond为90.1%,中文评测位居国内第一。此外,其Agent能力显著提升,已适配Claude Code等主流Agent产品。
根据评测,V4-Pro在SWE-bench Verified上得分为80.6%,接近Opus 4.6的80.8%。正式版在3D生成、SVG输出质量以及思维链(CoT)风格上较预览版有所改善,推理步骤更加简洁可读。
在功能集成上,V4正式版原生支持工具调用、联网搜索及结构化JSON输出。其联网搜索提供Thinking模式(多轮搜证并标注来源)和Non-thinking模式(快速搜索)两种推理模式。
定价策略与开源生态
DeepSeek V4在定价上引入了国内首创的“峰谷分时计费”机制。根据该机制,高峰时段(9:00-12:00、14:00-18:00)价格较高,而夜间算力费用可直降60%。
具体API定价(非高峰时段)为:V4-Pro输出价格为6元/百万Token,V4-Flash输出价格为2元/百万Token。对比行业定价,V4 Pro的平时输出价格仅为Fable 5的1/57,为GPT-5.6 Sol的1/34。
在开源协议方面,V4系列采用MIT或Apache 2.0许可,支持社区自由部署、微调与二次开发。
体验渠道与迁移提醒
用户可通过chat.deepseek.com网页版、官方App或API调用体验DeepSeek-V4。API调用时,模型名需设为deepseek-v4-pro或deepseek-v4-flash。
DeepSeek提醒用户,旧模型名deepseek-chat和deepseek-reasoner将于2026年7月24日停用,请尽快完成迁移。
评论区
已通过 0 条 · 审核通过后展示