DeepSeek 发布多模态模型 DeepSeek-V4-Flash-Vision-Exp
DeepSeek API 平台正式上线全新的多模态视觉理解模型
DeepSeek-V4-Flash-Vision-Exp。 据官方数据,该模型的纯文本能力持平DeepSeek-V4-Flash,多模态 Agent 能力接近Opus-4.8。 该模型支持三种主流API格式调用,图片会转换成token后按token计费,一张图片最多占 384tokens,计费价格与V4-Flash模型一致。 与此同时,官方上线不收费的Files API,用户可先将图片上传,再在请求中引用。
DeepSeek 官方发布多模态视觉理解实验模型 DeepSeek-V4-Flash-Vision-Exp,即日起可在 API 平台调用。
多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用。
官方数据显示该纯文本能力与 V4-Flash 正式版持平,多模态 Agent 能力接近 Opus-4.8,视觉理解类 Agent 基准较 V4-Flash 大幅跃升。
模型上下文长度 1M,最大输出 384K,单张图片 token 消耗上限 384 个。
单个请求最多含 600 张图片,图片按尺寸换算为 token 与文本一同计费。
定价方面与 DeepSeek-V4-Flash 保持一致。与此同时,官方上线不收费的 Files API。
用户可先将图片上传,再在请求中引用,从而节省带宽。




相关链接:























