# DeepSeek V4-Flash-Vision-Exp 上线，开启多模态 API 服务

- 来源：IT之家（RSS）
- 发布时间：2026-08-21 17:21
- AIHOT 分数：63
- AIHOT 链接：https://aihot.virxact.com/items/cmt2qt2jk03xaro6t5522pdpq
- 原文链接：https://www.ithome.com/0/992/755.htm

## AI 摘要

深度求索发布多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp，已上线 API 平台。该模型纯文本能力与 V4-Flash 正式版持平，视觉理解 Agent Benchmark 表现大幅跃升，接近 Opus-4.8。API 按 token 计费，单张图片最多占 384 tokens，价格与 V4-Flash 一致，支持三种调用格式及三种图片传入方式。

## 正文

IT之家 8 月 21 日消息，深度求索官方刚刚宣布全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。

深度求索官方表示，V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力，能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。

IT之家提醒：这是一个实验性质的模型，用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。

平衡文本与多模态能力

据介绍，在纯文本能力（Agent、推理、世界知识等）方面，DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash 正式版持平；在需要视觉理解的 Agent Benchmark 上，DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升，多模态 Agent 能力已接近 Opus-4.8。

API 支持

用户可以通过设置 model='deepseek-v4-flash-vision-exp' 来访问 V4-Flash-Vision-Exp 模型的 API。在 API 服务中，图片会转换成 token 后按 token 计费，一张图片最多占 384 tokens，计费价格与 V4-Flash 模型一致。

多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用，可以方便接入各类 Agent 工具中使用，支持图文混合输入，支持 base64 内联、外部 URL、Files API 三种图片传入方式。使用说明请参考官方 API 文档：API 指南 - 图像理解。

Files API 上线

Files API 现已开放，该 API 不收费，用户可先将图片上传到平台，再在请求中通过 file_id 引用，从而节省请求带宽。同一张图片在多个请求中无需重复上传。详细使用说明请参考官方 API 文档：API 指南 - Files API。
