DeepSeek发布V4-Flash-Vision-Exp多模态实验模型,API已上线
DeepSeek-V4-Flash-Vision-Exp在文本能力上与V4-Flash持平,多模态智能体性能接近Opus-4.8,每张图像按最多384个token计费。
AI解读:DeepSeek这次发布的是一个实验性多模态模型,让开发者能在一个API里同时处理文本和图像,解决了此前需要分别调用不同模型或额外处理图片的麻烦。对做智能体应用的团队来说,变化更直接:在基准测试中,它的多模态智能体性能比V4-Flash大幅提升,已经接近Opus-4.8,这意味着像“看懂截图再操作软件”这类任务,用DeepSeek就能跑得更顺,不必贵价买其他家模型。计费上图像按最多384个token计价,沿用V4-Flash的文本价格,成本可控;同时Files API免费,图片传一次就能反复复用,能省请求带宽。不过要留意:它仍是实验版,没有公布具体评测细节,实际表现可能和基准有出入,短期先在小流量场景试用更稳,不必马上把生产流量切过去。
DeepSeek于2026年8月21日宣布,实验性多模态模型DeepSeek-V4-Flash-Vision-Exp已在DeepSeek API平台上线,开发者可通过model='deepseek-v4-flash-vision-exp'调用。
该公司称,该模型在文本能力(包括智能体、推理和世界知识)上与DeepSeek-V4-Flash持平;在多模态智能体基准上相较于V4-Flash有大幅提升,性能接近Opus-4.8。
API与定价
DeepSeek表示,V4-Flash-Vision-Exp支持混合文本+图像输入,图像可通过base64、外部URL或Files API提供,并支持Chat Completions、Messages与Responses接口。
计费方面,图像按token计费,每张最多384个token,价格沿用V4-Flash标准。
- 支持混合文本+图像输入
- 图像可通过base64、外部URL或Files API提供
- 支持Chat Completions、Messages与Responses接口
Files API与工具链更新
DeepSeek同时上线了Files API,免费使用:用户可上传一次图片,之后通过file_id引用,节省请求带宽,并可在多次请求中复用同一张图片。
DeepSeek还发布了Harness 0.1.1,开箱即支持新模型,方便在智能体框架中结合视觉理解与各类工具。
- Files API免费使用
- 上传一次图片后通过file_id引用
- 支持跨请求复用,避免重复上传
- Harness 0.1.1提供对新模型的开箱支持