DeepSeekV4视觉模型上线 DeepSeek 今天正式上线了首款视觉理解模型:DeepSeek-V4-Flash-Vision-Exp。
简单的说,过去DeepSeek只能读文字、会推理、能调用工具,现这个视觉理解模型开始补齐自身的视觉能力,等于是多模态的最后一块拼图给装上了。
难得的是,加上眼睛之后,DeepSeek的文本、推理、Agent 等核心能力并没有缩水,依然保持原来的水准;而看图、理解图表、识别界面等视觉能力却大幅提升,多模态 Agent 表现已接近顶尖水平。
对开发者来说,接入方式很友好,支持 OpenAI 和 Anthropic 兼容接口;图片按 token 计费,价格与文本模型保持一致,没有额外负担。同步开放的 Files API 支持图片上传后反复使用,省流量也更方便。
目前这个新模型还是实验版本,已经上线 DeepSeek API 平台。想让模型看懂图、再据此执行任务的朋友,可以抢先试试。热点观点热点解读


