DeepSeek预告整体上调API价格,称预计涨幅较大

DeepSeek 预告近期整体上调 API 服务价格,并称预计涨幅较大。此次消息针对开放平台 API;现行 V4-Flash 与 V4-Pro 仍按输入、输出及缓存命中情况分别计费,开发者可以先用当前单价核算项目的成本基线。
DeepSeek整体上调API价格预告与开发者成本规划封面

DeepSeek预告整体上调API服务价格

DeepSeek 于 8 月 6 日向 API 用户发出调价预告:平台计划近期整体上调 API 服务定价,预计涨幅较大,并提醒用户合理安排使用。公告指向开放平台提供的 API 服务,也就是开发者把 DeepSeek 模型接入网站、软件或自动化流程时使用的接口。

DeepSeek 定价文档当前列出 V4-Flash 与 V4-Pro 的现行单价。对正在开发或运营 AI 产品的团队来说,最直接的准备工作是保存当前用量结构,用现价建立成本基线,正式调价后再按同一组数据重算。

两款模型现行价格差距集中在未缓存输入和输出

DeepSeek API 按 Token 计费。Token 是模型处理文本时使用的计量单位,一个汉字、英文单词片段、数字或标点都可能占用 Token。账单把输入和输出分开计算,输入又分为缓存命中与缓存未命中两档。

当前人民币价格以每 100 万 Token 为单位:

模型 输入(缓存命中) 输入(缓存未命中) 输出
DeepSeek-V4-Flash 0.02 元 1 元 2 元
DeepSeek-V4-Pro 0.025 元 3 元 6 元

缓存命中指请求开头的内容与此前处理过的内容相同,平台可以复用已经完成的计算。固定系统提示词、重复发送的工具说明或稳定的长文档前缀,都可能形成可复用内容。缓存未命中时,模型需要重新处理输入,因此价格更高。

如果一次任务分别消耗 100 万 Token 的未缓存输入和 100 万 Token 的输出,按现价计算,V4-Flash 为 3 元,V4-Pro 为 9 元。相同输入全部命中缓存时,两者分别为 2.02 元和 6.025 元。真实账单取决于每次请求的输入、输出和缓存命中量,不能只看单独一栏价格。

调价前先按真实用量重算预算

API 成本通常不是由调用次数单独决定。长文档、代码仓库、多轮智能体任务会持续携带上下文,并产生不同长度的输出。两个每天调用次数相同的应用,如果输入长度、输出长度或缓存命中率不同,月度费用也会相差很多。

开发者可以先把最近一段时间的用量拆成三项:缓存命中输入、缓存未命中输入和输出,再分别乘以当前单价。这样得到的不是新价格预测,而是一份可复用的现价账单模型。正式调价后,只需替换单价,就能看到同等用量下的成本变化。

对需要长期运行的服务,模型单价不宜写死在业务代码里。把 V4-Flash、V4-Pro 及不同计费项放入独立配置,可以在价格变化后更新预算和告警阈值,也能避免为了改一个数字重新发布整套应用。批量总结、离线分析等可调整运行时间的任务,还应把执行时间作为成本参数保留。

充值也应按实际调用量安排。DeepSeek 的扣费规则按 Token 消耗与模型单价计算,定价页面同时提醒用户依据实际用量按需充值。对个人开发者和小团队来说,先估算一周或一个月的真实消耗,比按调用次数粗略猜测更容易控制风险。

普通聊天用户不用把API价格等同于应用收费

API 是给开发者和企业接入模型的服务,与直接打开 DeepSeek 网页或 App 对话不是同一个计费入口。此次调价预告的对象是 DeepSeek API 服务,因此受影响最直接的是使用 API Key 发起请求的程序、插件、智能体和企业系统。

如果你只是通过网页或 App 使用 DeepSeek,这条公告本身不等于客户端收费方式发生变化。判断自己是否属于此次调价范围,可以看实际使用时是否配置了 DeepSeek API Key、是否按 Token 扣费。满足这两个条件,就应按当前价目表先做一次成本核算。