DeepSeek V4 Flash Vision Exp
DeepSeek V4 Flash 实验版视觉模型,支持图像理解与长上下文
DeepSeek V4 Flash Vision Exp 是 DeepSeek V4 系列实验版视觉模型,支持文本和图片输入、1M 上下文、最大 384K 输出以及思考与非思考模式
stars能力特性
visibility视觉理解code函数调用data_object结构化输出
payments上下文与价格
上下文长度1,000,000
最大输出384,000
输入价格¥3/ 每 1M tokens
输出价格¥9/ 每 1M tokens
缓存输入价格¥0.1/ 每 1M tokens
description详细介绍
模型概述
DeepSeek V4 Flash Vision Exp 是 DeepSeek 官方 API 文档收录的实验版视觉模型,模型 ID 为 deepseek-v4-flash-vision-exp,当前版本为 DeepSeek-V4-Flash-Vision-Exp。它支持文本和图片输入、1M 上下文、最大 384K 输出、Tool Calls、JSON Output、Responses API 和 Anthropic API
图像计费
图片会按尺寸换算成 tokens,并与文本 tokens 一并按照输入价格计费。实际图片 token 消耗应以 DeepSeek 官方图像理解文档和 API 返回用量为准
lightbulb典型场景
- 图片内容理解与问答
- 截图和界面分析
- 图文文档理解
- 视觉信息提取
thumb_up优势特点
- 支持文本和图片输入
- 1M 上下文
- 最大 384K 输出
- 支持 Tool Calls 和结构化输出
info局限性
- 属于实验版模型,接口和能力可能调整
- 图片会转换为 tokens 并产生输入费用
- 视觉准确率需要按业务场景实测
- 价格和峰谷规则应以官方文档为准
微信扫一扫