搜索


2026年8月21日,DeepSeek API平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,开发者通过 model='deepseek-v4-flash-vision-exp' 即可调用,支持JPEG/PNG/GIF/WebP图文混合输入,兼容Chat Completions、Messages、Responses三种格式,图片按token计费(单张上限384 tokens),费率与原V4-Flash一致,同步开放免费Files API 。官方数据显示:纯文本Agent、推理与世界知识能力与V4-Flash正式版持平;在需视觉理解的Agent Benchmark上大幅跃升,多模态Agent能力已接近Claude Opus-4.8(如Terminal Bench 2.1达83.9、DeepSWE 59.3等)。对跨境电商而言,该模型可直接落地“截图审竞品详情页、识别平台违规文案、解析广告后台图表、批量处理退货图片、多语种图文客服”等场景,以Flash级成本获得近旗舰级视觉Agent能力,中小卖家搭建自动化运营工作流的门槛进一步降低
