返回模型广场
DeepSeek
模型 ID:

deepseek/deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp 是 DeepSeek 于 2026 年 8 月 21 日发布的实验性(Experimental)多模态视觉理解模型,可通过 `deepseek-v4-flash-vision-exp` 模型名在 DeepSeek API 平台调用。它在 DeepSeek V4 Flash 基础上额外接受图像输入,可用于图像描述、截图文字识别、图表分析等图文混合任务。

立即接入
发布时间:2026.08.21
工具调用结构化输出图像理解内容缓存
上下文
1000K
最大输出
384K
输入类型
文本 / 图像
输出类型
文本
价格方案
不同上下文区间和计费项可能采用不同单价,请以请求实际命中的价格规则为准。
条件计费项高峰价格闲时价格
输入长度 (0, 无限] 且输出长度 (0, 无限]缓存输入0.0001 元 / K0.00005 元 / K
非缓存输入0.003 元 / K0.0015 元 / K
输出0.009 元 / K0.0045 元 / K
API 接入
使用模型 ID 和对应的 Base URL,即可通过兼容接口接入模型。
Model ID
deepseek/deepseek-v4-flash-vision-exp
用于在推理接口中指定模型
API Key
用于设置推理接口的 Bearer Token(OAuth 2.0 认证令牌)
Completions BaseURL
https://api.qnaigc.com/v1
兼容 Completions 接口(即 /chat/completions),支持 OpenAI SDK、Codex 等
Messages BaseURL
https://api.qnaigc.com/
兼容 Messages 接口(即 /v1/messages),支持配置到 Claude Code 等工具
API 文档
详细的接口说明、参数定义和使用示例
模型介绍
关于模型能力、适用场景与使用限制的官方说明。

模型简介

DeepSeek V4 Flash Vision Exp 是 DeepSeek 于 2026 年 8 月 21 日发布的实验性多模态视觉理解模型。它在 DeepSeek V4 Flash 基础上支持图像输入,模型版本为 DeepSeek-V4-Flash-Vision-Exp,可通过 deepseek-v4-flash-vision-exp 模型名在 DeepSeek API 平台调用,适合图像描述、截图文字识别、图表分析等图文混合任务。

核心能力

  • 图文理解:支持文本与图像输入,输出文本
  • 1M 上下文:上下文长度 1M tokens,最大输出 384K tokens
  • 思考模式:支持思考(默认)与非思考两种模式
  • 工具与结构化输出:支持 Tool Calls 与 JSON Output
  • 多协议接入:支持 OpenAI 格式与 Anthropic 格式 API,以及 Responses API
  • 上下文缓存:支持上下文硬盘缓存,命中缓存的价格更低
  • Chat Prefix Completion(Beta):支持对话前缀续写;不支持 FIM Completion

计费说明

图像按尺寸折算为 tokens,与文本一起作为输入 tokens 计费;本模型采用高峰/空闲分时计价,空闲时段费率为高峰时段的一半,详见官方定价页。