DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash 实验版视觉模型,支持图像理解与长上下文

已发布

DeepSeek V4 Flash Vision Exp 是 DeepSeek V4 系列实验版视觉模型,支持文本和图片输入、1M 上下文、最大 384K 输出以及思考与非思考模式

stars能力特性

visibility视觉理解code函数调用data_object结构化输出

payments上下文与价格

上下文长度1,000,000
最大输出384,000
输入价格¥3/ 每 1M tokens
输出价格¥9/ 每 1M tokens
缓存输入价格¥0.1/ 每 1M tokens

description详细介绍

模型概述

DeepSeek V4 Flash Vision Exp 是 DeepSeek 官方 API 文档收录的实验版视觉模型,模型 ID 为 deepseek-v4-flash-vision-exp,当前版本为 DeepSeek-V4-Flash-Vision-Exp。它支持文本和图片输入、1M 上下文、最大 384K 输出、Tool Calls、JSON Output、Responses API 和 Anthropic API

图像计费

图片会按尺寸换算成 tokens,并与文本 tokens 一并按照输入价格计费。实际图片 token 消耗应以 DeepSeek 官方图像理解文档和 API 返回用量为准

lightbulb典型场景

  • 图片内容理解与问答
  • 截图和界面分析
  • 图文文档理解
  • 视觉信息提取

thumb_up优势特点

  • 支持文本和图片输入
  • 1M 上下文
  • 最大 384K 输出
  • 支持 Tool Calls 和结构化输出

info局限性

  • 属于实验版模型,接口和能力可能调整
  • 图片会转换为 tokens 并产生输入费用
  • 视觉准确率需要按业务场景实测
  • 价格和峰谷规则应以官方文档为准

link参考来源

以上内容综合整理自官方文档与公开资料,具体以官方为准