【天顺财经】8 月 21 日消息,刚刚,DeepSeek 官方正式宣布,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。这意味着,在纯文本模型 V4-Flash 奠定行业标杆之后,DeepSeek 终于补齐了 「视觉理解」 这块重要拼图,向开发者正式开放了多模态 API 能力。
DeepSeek 强调,作为一款 「实验性模型」,DeepSeek-V4-Flash-Vision-Exp 在纯文本能力 (Agent、推理、世界知识等) 方面与 DeepSeek-V4-Flash 正式版持平,后者此前已在 Arena.ai 前端编码排行榜上首次超越 Opus 4.8,并以同级别最优的性价比备受开发者青睐。在需要视觉理解的 Agent Benchmark 测试中,DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近 Opus-4.8。

多模态 Agent 能力全面解锁
V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了出色的多模态适配能力,能够有效支持开发者借助多样化的 Agent 工具解锁更多实用工作场景。
DeepSeek 官方同步展示了多个极具代表性的应用示例:
商业 PPT 生成:在 Agent 框架下生成商业定制西藏自驾游 PPT,要求模型输出 「野性、原始、探索感」 的高端定制方案,包含三种真实定价方案,所有配图采用实拍质感风格。
网站二次创作:对 DeepSeek Harness 官网进行未来主义风格重构,运用黑蓝深海、玻璃 UI 和 ASCII 原子像素等视觉要素,经过长多轮交互完成创意设计。
前端动态特效:基于 「一群可爱的 3D 黏土小怪物加入跃动复古舞池派对」 的创意提示,制作黏土怪物风格动态特效的前端 Mini Demo。
API 服务正式开放,Files API 同步上线,计费灵活透明
开发者可以通过设置 `model="deepseek-v4-flash-vision-exp"` 来访问该模型的 API。在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型保持一致。

多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用,可方便接入各类 Agent 工具,支持图文混合输入,并提供 base64 内联、外部 URL、Files API 三种图片传入方式。

伴随多模态 API 一同上线的还有 Files API,该 API 不收费,用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而大幅节省请求带宽,同一张图片在多个请求中无需重复上传。
DeepSeek 此次推出多模态视觉理解模型,标志着其从纯文本大模型向多模态 AI 全面进军的战略升级。在此之前,DeepSeek Harness 已于 8 月 19 日发布 v0.1.0-rc.8 版本,带来 14 项更新,涵盖多模态输入、子 Agent 协作等能力。此次 V4-Flash-Vision-Exp 的正式上线,与此前 Harness 的更新形成了完整的 「工具链+模型」 闭环。
在定价方面,新模型延续了 DeepSeek 一贯的高性价比路线,考虑到 V4-Flash 此前以 「价格低至竞品 1%」 著称,这一多模态 API 的定价策略无疑将进一步降低开发者接入多模态能力的门槛。
业内分析认为,DeepSeek 此次推出的多模态视觉模型,在保持纯文本能力不妥协的前提下,将视觉理解 Agent 能力推至接近行业顶尖水平 Opus-4.8。随着多模态 API 的全面开放,开发者生态有望迎来新一轮创新爆发。
【天顺财经】8 月 21 日消息,刚刚,DeepSeek 官方正式宣布,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。这意味着,在纯文本模型 V4-Flash 奠定行业标杆之后,DeepSeek 终于补齐了 「视觉理解」 这块重要拼图,向开发者正式开放了多模态 API 能力。
DeepSeek 强调,作为一款 「实验性模型」,DeepSeek-V4-Flash-Vision-Exp 在纯文本能力 (Agent、推理、世界知识等) 方面与 DeepSeek-V4-Flash 正式版持平,后者此前已在 Arena.ai 前端编码排行榜上首次超越 Opus 4.8,并以同级别最优的性价比备受开发者青睐。在需要视觉理解的 Agent Benchmark 测试中,DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近 Opus-4.8。

多模态 Agent 能力全面解锁
V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了出色的多模态适配能力,能够有效支持开发者借助多样化的 Agent 工具解锁更多实用工作场景。
DeepSeek 官方同步展示了多个极具代表性的应用示例:
商业 PPT 生成:在 Agent 框架下生成商业定制西藏自驾游 PPT,要求模型输出 「野性、原始、探索感」 的高端定制方案,包含三种真实定价方案,所有配图采用实拍质感风格。
网站二次创作:对 DeepSeek Harness 官网进行未来主义风格重构,运用黑蓝深海、玻璃 UI 和 ASCII 原子像素等视觉要素,经过长多轮交互完成创意设计。
前端动态特效:基于 「一群可爱的 3D 黏土小怪物加入跃动复古舞池派对」 的创意提示,制作黏土怪物风格动态特效的前端 Mini Demo。
API 服务正式开放,Files API 同步上线,计费灵活透明
开发者可以通过设置 `model="deepseek-v4-flash-vision-exp"` 来访问该模型的 API。在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型保持一致。

多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用,可方便接入各类 Agent 工具,支持图文混合输入,并提供 base64 内联、外部 URL、Files API 三种图片传入方式。

伴随多模态 API 一同上线的还有 Files API,该 API 不收费,用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而大幅节省请求带宽,同一张图片在多个请求中无需重复上传。
DeepSeek 此次推出多模态视觉理解模型,标志着其从纯文本大模型向多模态 AI 全面进军的战略升级。在此之前,DeepSeek Harness 已于 8 月 19 日发布 v0.1.0-rc.8 版本,带来 14 项更新,涵盖多模态输入、子 Agent 协作等能力。此次 V4-Flash-Vision-Exp 的正式上线,与此前 Harness 的更新形成了完整的 「工具链+模型」 闭环。
在定价方面,新模型延续了 DeepSeek 一贯的高性价比路线,考虑到 V4-Flash 此前以 「价格低至竞品 1%」 著称,这一多模态 API 的定价策略无疑将进一步降低开发者接入多模态能力的门槛。
业内分析认为,DeepSeek 此次推出的多模态视觉模型,在保持纯文本能力不妥协的前提下,将视觉理解 Agent 能力推至接近行业顶尖水平 Opus-4.8。随着多模态 API 的全面开放,开发者生态有望迎来新一轮创新爆发。
【天顺财经】8 月 21 日消息,刚刚,DeepSeek 官方正式宣布,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。这意味着,在纯文本模型 V4-Flash 奠定行业标杆之后,DeepSeek 终于补齐了 「视觉理解」 这块重要拼图,向开发者正式开放了多模态 API 能力。
DeepSeek 强调,作为一款 「实验性模型」,DeepSeek-V4-Flash-Vision-Exp 在纯文本能力 (Agent、推理、世界知识等) 方面与 DeepSeek-V4-Flash 正式版持平,后者此前已在 Arena.ai 前端编码排行榜上首次超越 Opus 4.8,并以同级别最优的性价比备受开发者青睐。在需要视觉理解的 Agent Benchmark 测试中,DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近 Opus-4.8。

多模态 Agent 能力全面解锁
V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了出色的多模态适配能力,能够有效支持开发者借助多样化的 Agent 工具解锁更多实用工作场景。
DeepSeek 官方同步展示了多个极具代表性的应用示例:
商业 PPT 生成:在 Agent 框架下生成商业定制西藏自驾游 PPT,要求模型输出 「野性、原始、探索感」 的高端定制方案,包含三种真实定价方案,所有配图采用实拍质感风格。
网站二次创作:对 DeepSeek Harness 官网进行未来主义风格重构,运用黑蓝深海、玻璃 UI 和 ASCII 原子像素等视觉要素,经过长多轮交互完成创意设计。
前端动态特效:基于 「一群可爱的 3D 黏土小怪物加入跃动复古舞池派对」 的创意提示,制作黏土怪物风格动态特效的前端 Mini Demo。
API 服务正式开放,Files API 同步上线,计费灵活透明
开发者可以通过设置 `model="deepseek-v4-flash-vision-exp"` 来访问该模型的 API。在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型保持一致。

多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用,可方便接入各类 Agent 工具,支持图文混合输入,并提供 base64 内联、外部 URL、Files API 三种图片传入方式。

伴随多模态 API 一同上线的还有 Files API,该 API 不收费,用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而大幅节省请求带宽,同一张图片在多个请求中无需重复上传。
DeepSeek 此次推出多模态视觉理解模型,标志着其从纯文本大模型向多模态 AI 全面进军的战略升级。在此之前,DeepSeek Harness 已于 8 月 19 日发布 v0.1.0-rc.8 版本,带来 14 项更新,涵盖多模态输入、子 Agent 协作等能力。此次 V4-Flash-Vision-Exp 的正式上线,与此前 Harness 的更新形成了完整的 「工具链+模型」 闭环。
在定价方面,新模型延续了 DeepSeek 一贯的高性价比路线,考虑到 V4-Flash 此前以 「价格低至竞品 1%」 著称,这一多模态 API 的定价策略无疑将进一步降低开发者接入多模态能力的门槛。
业内分析认为,DeepSeek 此次推出的多模态视觉模型,在保持纯文本能力不妥协的前提下,将视觉理解 Agent 能力推至接近行业顶尖水平 Opus-4.8。随着多模态 API 的全面开放,开发者生态有望迎来新一轮创新爆发。
【天顺财经】8 月 21 日消息,刚刚,DeepSeek 官方正式宣布,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。这意味着,在纯文本模型 V4-Flash 奠定行业标杆之后,DeepSeek 终于补齐了 「视觉理解」 这块重要拼图,向开发者正式开放了多模态 API 能力。
DeepSeek 强调,作为一款 「实验性模型」,DeepSeek-V4-Flash-Vision-Exp 在纯文本能力 (Agent、推理、世界知识等) 方面与 DeepSeek-V4-Flash 正式版持平,后者此前已在 Arena.ai 前端编码排行榜上首次超越 Opus 4.8,并以同级别最优的性价比备受开发者青睐。在需要视觉理解的 Agent Benchmark 测试中,DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近 Opus-4.8。

多模态 Agent 能力全面解锁
V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了出色的多模态适配能力,能够有效支持开发者借助多样化的 Agent 工具解锁更多实用工作场景。
DeepSeek 官方同步展示了多个极具代表性的应用示例:
商业 PPT 生成:在 Agent 框架下生成商业定制西藏自驾游 PPT,要求模型输出 「野性、原始、探索感」 的高端定制方案,包含三种真实定价方案,所有配图采用实拍质感风格。
网站二次创作:对 DeepSeek Harness 官网进行未来主义风格重构,运用黑蓝深海、玻璃 UI 和 ASCII 原子像素等视觉要素,经过长多轮交互完成创意设计。
前端动态特效:基于 「一群可爱的 3D 黏土小怪物加入跃动复古舞池派对」 的创意提示,制作黏土怪物风格动态特效的前端 Mini Demo。
API 服务正式开放,Files API 同步上线,计费灵活透明
开发者可以通过设置 `model="deepseek-v4-flash-vision-exp"` 来访问该模型的 API。在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型保持一致。

多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用,可方便接入各类 Agent 工具,支持图文混合输入,并提供 base64 内联、外部 URL、Files API 三种图片传入方式。

伴随多模态 API 一同上线的还有 Files API,该 API 不收费,用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而大幅节省请求带宽,同一张图片在多个请求中无需重复上传。
DeepSeek 此次推出多模态视觉理解模型,标志着其从纯文本大模型向多模态 AI 全面进军的战略升级。在此之前,DeepSeek Harness 已于 8 月 19 日发布 v0.1.0-rc.8 版本,带来 14 项更新,涵盖多模态输入、子 Agent 协作等能力。此次 V4-Flash-Vision-Exp 的正式上线,与此前 Harness 的更新形成了完整的 「工具链+模型」 闭环。
在定价方面,新模型延续了 DeepSeek 一贯的高性价比路线,考虑到 V4-Flash 此前以 「价格低至竞品 1%」 著称,这一多模态 API 的定价策略无疑将进一步降低开发者接入多模态能力的门槛。
业内分析认为,DeepSeek 此次推出的多模态视觉模型,在保持纯文本能力不妥协的前提下,将视觉理解 Agent 能力推至接近行业顶尖水平 Opus-4.8。随着多模态 API 的全面开放,开发者生态有望迎来新一轮创新爆发。
















