指南 / DeepSeek Vision API 价格
DeepSeek Vision API 价格 (2026):一张图片的实际成本是多少
DeepSeek 的视觉模型 deepseek-v4-flash-vision-exp(2026年8月21日发布)的定价与 V4-Flash 完全相同 —— 每张图片的计费硬性上限为 384 tokens。本页提供了完整的费率表、图片 token 化规则、成本计算示例,以及 vision-exp 与西方视觉 API 的对比。以下所有数据均取自2026年8月21日的官方定价和视觉文档。
deepseek-v4-flash-vision-exp 的价格为:非高峰期每 1M 输入 tokens $0.22,高峰期 $0.44,每张图片上限为 384 tokens —— 因此一张最大尺寸的图片在非高峰期最多花费 $0.0000845,1,000 张截图的成本约为 $0.08。输出价格为每 1M tokens 非高峰期 $0.66 / 高峰期 $1.32;缓存命中输入为 $0.007 / $0.014。高峰时段:UTC 01:00–04:00 & 06:00–10:00(北京时间 09:00–12:00 & 14:00–18:00)。
完整费率表(美元 / 1M tokens)
| 费率 | 非高峰期 | 高峰期 | 人民币等值 |
|---|---|---|---|
| 输入 — 缓存命中 | $0.007 | $0.014 | ≈ ¥0.05 / ¥0.10 |
| 输入 — 缓存未命中 | $0.22 | $0.44 | ≈ ¥1.5 / ¥3.0 |
| 输出 | $0.66 | $1.32 | ≈ ¥4.5 / ¥9.0 |
| 并发限制 | 2,500(与 V4-Flash 相同;V4-Pro 为 500) | ||
来源:官方定价页面,读取于2026-08-21。在所有层级中,非高峰期价格正好是高峰期的一半。
图片规则:384 tokens 是如何计算的
- 推理前调整大小。 大约 384×384 像素以下的图片会被放大(保持宽高比);更大的图片会被缩小至相当于大约 800×800 像素的面积。
- 硬性上限为 384 tokens。 由于调整了大小,每张图片的上限为 384 tokens —— 2000×2000 的截图和 5000×5000 的照片成本完全相同。
- 每张图片独立计费。 在多图请求中,每张图片都会产生自己 ≤384 tokens 的费用;每次请求最多可发送 600 张图片。
- 格式与大小。 JPEG / PNG / GIF / WebP;内联或通过 URL 每张图片 32 MiB;通过 Files API file_id 可达 64 MiB;单边最大 8,192 像素(15张以上图片时为 4,096 像素)。
计算示例:你的工作负载成本是多少
| 场景(最大尺寸图片,缓存未命中) | Tokens | 非高峰期 | 高峰期 |
|---|---|---|---|
| 1 张截图 | ≤384 | $0.0000845 | $0.000169 |
| 1,000 张截图 | ≤384K | $0.0845 | $0.169 |
| 10,000 张截图 | ≤3.84M | $0.845 | $1.69 |
| 1,000 张重复的 UI 图片(缓存命中) | ≤384K | $0.0027 | $0.0054 |
图片周围的文本 tokens(提示词、工具输出、模型回复)在同一请求中按正常费率计费 —— 上述行仅单独计算图片部分的成本。
对比西方视觉 API(2026 目录价)
| 计费模式 | 输入 $/1M | 对比 vision-exp | 图片计费 |
|---|---|---|---|
| deepseek-v4-flash-vision-exp | $0.22 / $0.44 | 基准 | ≤384 tokens/图片,硬性上限 |
| Gemini 3.7 Flash (intro) | $0.75 | 1.7–3.4× | 取决于分辨率,无公开上限 |
| Grok 4.6 | $2.00 | 4.5–9.1× | 取决于分辨率 |
| Claude Sonnet 4.5 | $3.00 | 6.8–13.6× | 典型截图 ≈1,000+ tokens → ≈$0.003+/图片(估算) |
竞品目录价来自公开定价页面;其单图 token 数量因分辨率而异(标有估算)。结构性差异:vision-exp 将同类中最便宜的单 token 价格与唯一的单图 token 硬性上限结合在了一起。
削减视觉 API 账单的四种方法
- 将批处理任务移至非高峰期。 在 UTC 04:00–01:00 时段内价格正好减半;对于截图处理流水线来说,这意味着零代码改动即可削减 50% 的成本。
- 裁剪,不要全抛。 裁剪后的 UI 区域依然计费 ≤384 tokens,但能比全屏提供更好的回答 —— 成本下限相同,质量却能提升。
- 把重复图片放前面。 缓存命中输入的成本比未命中便宜约 31 倍($0.007 对比 $0.22)。将相同的标志/模板/UI 框架放在提示词开头即可命中缓存。
- 通过 Files API 复用。 上传一次,引用
file_id—— 无需在每次请求中重新上传臃肿的 base64。请参阅我们的 Files API 指南。
FAQ
在 DeepSeek 视觉模型中一张图片多少钱?
最多 384 tokens → 非高峰期 $0.0000845,高峰期 $0.000169。尺寸超过相当于 ~800×800 像素后不会增加成本。
高峰期是什么时候?
UTC 01:00–04:00 和 06:00–10:00 —— 北京时间 09:00–12:00 和 14:00–18:00。其他时间全部半价。
vision-exp 比普通的 v4-flash 更贵吗?
不 —— 费率完全相同。你只需为图片本身的 tokens 额外付费,每张上限 384。
既然是“实验性 (experimental)”的,价格会变吗?
可能会 —— 实验性模型可能会在短时间内更改定价或条款。这些是截至2026年8月21日的官方数据;在锁定预算前请重新查看定价页面。
相关推荐
ChinaModelAPI 是一个独立的兼容 OpenAI 格式的中继服务;上述价格是 DeepSeek 的官方目录价,而非中继价格。