视觉理解

1 条相关内容

怎么评价 DeepSeek-V4-Flash-Vision-Exp 发布,多模态能力表现如何?

怎么评价 DeepSeek-V4-Flash-Vision-Exp 发布,多模态能力表现如何?

DeepSeek于8月21日发布实验性多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp,并上线API平台。该模型支持图片、文本及简单视频帧输入,在图像描述、OCR识别和视觉问答方面表现良好。测试显示其推理速度快且显存占用低,在视觉理解的AgentBenchmark上较DeepSeek-V4-Flash有大幅提升,多模态Agent能力接近Opus-4.8。

知乎