如何看待 DeepSeek V4 PRO 9 月 14 日之后继续提供服务?
DeepSeek于2026年9月发布新模型V4.1 Flash,该模型采用新型因果编码器-解码器架构,支持原生图像处理,且在性能、成本和速度上被指优于原旗舰模型V4-Pro。自9月14日起,所有发送至V4-Pro的API请求将重定向至V4.1 Flash,并按后者的费率计费,直至V4.1 Pro版本发布。
热搜汇
共 5 条相关内容
DeepSeek于2026年9月发布新模型V4.1 Flash,该模型采用新型因果编码器-解码器架构,支持原生图像处理,且在性能、成本和速度上被指优于原旗舰模型V4-Pro。自9月14日起,所有发送至V4-Pro的API请求将重定向至V4.1 Flash,并按后者的费率计费,直至V4.1 Pro版本发布。
DeepSeek于8月21日发布实验性多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp,并上线API平台。该模型支持图片、文本及简单视频帧输入,在图像描述、OCR识别和视觉问答方面表现良好。测试显示其推理速度快且显存占用低,在视觉理解的AgentBenchmark上较DeepSeek-V4-Flash有大幅提升,多模态Agent能力接近Opus-4.8。
DeepSeek于2026年7月31日发布V4-Flash正式版API(版本号V4-Flash-0731)并开启公测。该版本在模型结构与参数规模上与预览版保持一致,但通过重新进行后训练,显著提升了代码修改、工具调用等Agent能力,在多项基准测试中反超V4-Pro预览版。此外,该模型首次原生支持Responses API并适配Codex,提供极高性价比。
2026年7月25日,OpenAI旗下ChatGPT、Codex及API等多项服务出现全球性大规模宕机,影响范围覆盖北美、欧洲及亚太三大时区。此次故障导致31项服务组件性能下降,DownDetector平台告警量峰值突破127万次/小时。OpenAI确认故障后进行调查,相关服务在约1小时51分钟后恢复。据匿名工程师透露,故障源于一次非预期级联扩容导致的系统语义冲突。
谷歌近日上线三款轻量化Gemini迭代模型:3.6 Flash、3.5 Flash-Lite及3.5 Flash Cyber,旨在覆盖企业全场景轻量化AI需求并降低部署成本。尽管3.6 Flash在性能和成本上有所提升,但原定于6月底上线的旗舰模型Gemini 3.5 Pro却出现延期。此外,Meta首席AI官Alexandr Wang针对谷歌模型表现发表挑衅言论,引发行业关注。