DC娱乐网

多模态视觉理解模型DeepSeek V4-Flash-Vision-Exp上线

凤凰网科技讯8月21日,DeepSeek官方发文宣布,全新的多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp上线DeepSeekAPI平台,并将其称为“一个实验性质的模型”。

官方表示,V4-Flash-Vision-Exp在纯文本能力方面,已与DeepSeek-V4-Flash正式版持平;在需要视觉理解的AgentBenchmark上,多模态Agent能力已接近Opus-4.8。

该模型在各类Agent框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的Agent工具解锁更多实用的工作场景。

据官方介绍,用户可以通过设置model='deepseek-v4-flash-vision-exp'来访问V4-Flash-Vision-Exp模型的API。在API服务中,图片会转换成token后按token计费,一张图片最多占384tokens,计费价格与V4-Flash模型一致。

多模态API支持ChatCompletions、Messages、Responses三种格式调用,可以方便接入各类Agent工具中使用,支持图文混合输入,支持base64内联、外部URL、FilesAPI三种图片传入方式。使用说明请参考官方API文档:API指南-图像理解。