模型经济学
DeepSeek API 价格:读懂 Token、缓存与高峰时段计费
基于官方文档,拆解 DeepSeek API 的输入、输出、缓存和高峰/非高峰价格,并给出可复现的预算方法。
deepseek api pricing方案比较US编辑简报更新 2026-08-27

你将学会
- Estimate input, output, and cache-hit tokens separately.
- Peak and off-peak rules can materially change the rate.
- Use current provider documentation and live usage records before launch.
开始前需要
- Basic HTTP and API knowledge
Leave with a concrete implementation checklist and a testable starting point.
先看结论
- 输入、输出和缓存命中必须分开估算。
- 高峰与非高峰规则可能显著影响价格。
- 预算要关联模型、端点、时间和真实用量。
计费单位是百万 Token
DeepSeek 按每百万 Token 列出输入和输出价格。预算时必须把输入、输出和缓存命中分开,否则长上下文或长回答会让估算严重偏差。
不要拿一个 headline 价格代表整次请求;系统提示词、检索文档和推理输出都会改变成本结构。
缓存和时段会改变结果
官方价格页区分缓存命中与未命中,并说明高峰和非高峰时段。重复上下文的工作负载应单独测量缓存命中率,定时批处理则要记录 UTC 请求时段。
价格会更新,旧截图不能作为生产依据;上线前必须重新核对当前价格页。
建立可复现的估算
保存真实提示词、Token 数、模型、端点、缓存状态和请求时间,再分别计算输入、输出与缓存成本,最后乘以月请求量。
将估算与账户用量记录对账,才能发现模型版本或请求形态变化。
如何选择
| 比较维度 | 方案 A | 方案 B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
实施步骤
- 1
采集代表性提示词和 Token 数。
- 2
记录模型、端点、缓存状态和 UTC 时间。
- 3
分别计算各项成本。
- 4
上线前用实时账户用量复核。
可复制示例
ts
const cost =
inputTokens / 1_000_000 * inputRate +
outputTokens / 1_000_000 * outputRate +
cachedTokens / 1_000_000 * cacheRate;常见问题
DeepSeek 价格会永久不变吗?
不会。官方明确提示价格可能调整,应以实时价格页和账户用量为准。
资料来源
- DeepSeek Models & Pricing来源核查 2026-08-27
- DeepSeek Token Usage来源核查 2026-08-27