8 月 21 日晚间,国产大模型厂商 DeepSeek 宣布全新多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 正式上线 DeepSeek API 平台。据上海证券报、财联社等多家媒体报道,该模型被官方定义为”实验性质的模型”,用户可通过设置 model=’deepseek-v4-flash-vision-exp’ 进行访问。在纯文本能力方面,该模型与 DeepSeek-V4-Flash 正式版持平,推理、Agent 调度、世界知识等核心能力保持稳定。真正的提升集中在视觉理解维度——在需要视觉理解的 Agent Benchmark 上,DeepSeek-V4-Flash-Vision-Exp 相比 V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近海外头部模型 Opus-4.8 的水平。业内人士指出,多模态 Agent 是当前 AI 产业竞争的核心赛道,以往国内模型在结合图像、视频完成复杂任务的智能体能力方面与国际顶尖水平存在差距,此次 DeepSeek 将视觉 Agent 能力拉至接近国际第一梯队,标志着国产大模型在多模态 Agent 方向迈出关键一步,进一步强化了市场对多模态 AI 和智能体赛道的预期。