一份写着「降」的公告,和两张并排的官方价格表
DeepSeek 2026 年 8 月 17 日零点改按峰谷计价。公告没有「涨价」二字,两张官方表并排:最低 1.52 倍,最高 12.14 倍

文章目录
共 4 节$0.435 和 $1.32。前一个是 DeepSeek V4-Pro 在 2026 年 8 月 16 日之前的输入价(未命中缓存,每百万 token),后一个是同一个模型同一档在调价之后的峰时价。中间隔着一份公告,公告里配了一个向下的箭头,通篇没有出现「涨价」两个字。
这篇不讲「该换成谁」。DeepSeek 官方 2026 年 8 月 13 日的那份公告把话说得很清楚:新价自 2026 年 8 月 16 日 16:00 UTC 起生效,折成北京时间是 8 月 17 日零点;非高峰费率比高峰低 50%。我们去核对的是另一件事——公告给出的对照面,是新价表内部的「峰」和「谷」;而买单的人要看的对照面,是生效前的那张表和生效后的这张表。两个对照面,结论方向相反。
本文所有价格数字的采集日是 2026 年 8 月 18 日,旧价来自同一个官方定价页在 2026 年 8 月 15 日 11:10 UTC 的存档快照。站内此前那份 8 月初的价格附录里,DeepSeek 那一条已经被这次调价推翻,以本文为准。
一、公告写的那句话是对的,只是它对照的不是你手上那张旧账单
先把公告原文的口径摆清楚,因为它没有说错。
据 DeepSeek 官方 API 文档 2026 年 8 月 13 日发布的 V4-Pro 正式版说明,这次改动包含三件事:DeepSeek-V4-Pro(快照 0813)在 App、网页与 API 三端同时上线正式版;V4-Pro 与 V4-Flash 同时新增 `reasoning_effort` 的 low / high / max 三档;以及价格改成峰谷分时,非高峰费率比高峰低 50%,自 2026 年 8 月 16 日 16:00 UTC 起生效。我们把这一页原文重新拉了一遍,「50% lower than peak」这句在页上,「涨价」这一类表述不在页上。
这两件事都是真的,而且不矛盾。公告在说的是新价表内部,谷时是峰时的一半;它没有承诺新价表相对旧价表是升还是降。差别就出在这里:一个人读完公告,脑子里留下的印象是「以后能更便宜」,于是不去动任何配置;而他账单上真正发生的事,取决于旧价到新价的比例,不取决于新价内部峰谷的比例。
所以我们做的事很朴素:把生效前后的两张官方表并排放。为了避免拿到的是媒体转述的数字,两张表都取自同一个官方定价页——新价是 2026 年 8 月 18 日实拉,旧价是同一个 URL 在 2026 年 8 月 15 日 11:10 UTC 的第三方存档快照,那个时点在生效之前。同一个页面、同一套字段、只差三天,这样并排才不会串位。
顺带说明一个容易混的点:DeepSeek 的官方定价页有美元页和人民币页两版。本文的倍数计算全部在美元页内部完成,不做汇率换算,也不把美元价和人民币价放进同一格里比。人民币口径另有官方数字,放在第三节。
还有一层容易被跳过:那份公告本身不是一份价格公告。它的主体是 V4-Pro 正式版上线,价格改动是其中一段。同一份公告里还写着两件与花钱无关的事——V4-Pro 与 V4-Flash 同时新增 `reasoning_effort` 的 low / high / max 三档,以及原生支持 OpenAI Responses API。一份以「新版本发布」为主体的公告,读的人注意力会落在版本上;价格那一段被当成附带信息扫过去,是很自然的阅读结果。这不是谁的疏忽,这是发布公告和采购决策天然不同步。结论只有一条操作性的:模型有新版本上线的那一周,顺手把它的定价页也拉一次。版本号和价格表经常在同一份公告里一起变,而多数人只记住了前者。
二、六行数字,最低 1.52 倍,最高 12.14 倍
下面这张表的左边一列是生效前的官方价,中间和右边两列是生效后的谷时价与峰时价,单位统一为美元每百万 token。最后两列是我们做的除法,分母都是同一行的旧价。
| 项目 | 旧价(生效前) | 新价·谷 | 新价·峰 | 谷/旧 | 峰/旧 |
|---|---|---|---|---|---|
| V4-Flash 输入·缓存命中 | $0.0028 | $0.007 | $0.014 | 2.50 倍 | 5.00 倍 |
| V4-Flash 输入·未命中 | $0.14 | $0.22 | $0.44 | 1.57 倍 | 3.14 倍 |
| V4-Flash 输出 | $0.28 | $0.66 | $1.32 | 2.36 倍 | 4.71 倍 |
| V4-Pro 输入·缓存命中 | $0.003625 | $0.022 | $0.044 | 6.07 倍 | 12.14 倍 |
| V4-Pro 输入·未命中 | $0.435 | $0.66 | $1.32 | 1.52 倍 | 3.03 倍 |
| V4-Pro 输出 | $0.87 | $1.98 | $3.96 | 2.28 倍 | 4.55 倍 |
六行,十二个比值,没有一个小于 1。最小的是 V4-Pro 未命中输入在谷时的 1.52 倍,最大的是 V4-Pro 缓存命中输入在峰时的 12.14 倍。据第一财经 2026 年 8 月的报道,其独立计算的结论是整体调价后为原价的 1.5 到 12 倍——这个区间和我们从两张官方表里算出来的两端对得上。两条口径互相印证,我们才把这张表放出来。
这张表里最该被单独拎出来的,是缓存命中那两行。缓存命中价在旧表里是三位小数以下的量级(V4-Pro 是 $0.003625),在新表里被抬到 $0.022 和 $0.044。倍数之所以大,正因为旧价的绝对值极小。这意味着一件很具体的事:过去靠「把长提示词做成稳定前缀吃缓存」省下来的那部分钱,在这个供应商上,省下来的绝对额度变小了。注意这不等于缓存不该做——缓存命中价依然远低于未命中价,新表里 V4-Pro 谷时命中是 $0.022,未命中是 $0.66,仍差 30 倍。它变的是这条优化的收益上限,不是它的方向。
还有一个对照值得一起看。据 OpenRouter 截至 2026 年 8 月 17 日的周榜(按 prompt 与 completion token 合计),榜首是 DeepSeek 的 Flash 档(周量 11.30T),旗舰 V4-Pro 的 0813 快照排在第 18 位(0.80T)。这份榜只反映「通过它调用」的那部分需求、且是前 20 名之间的相对量,不代表全平台份额,更不代表模型好坏——把它放在这里只说明一件事:真正在被大量消耗的是便宜档。而便宜档 V4-Flash 的三行倍数是 2.50、1.57、2.36(谷时)与 5.00、3.14、4.71(峰时),一行都没落下。
三、峰谷是几点:两个官方页面,两套时区写法
要错峰,先得知道峰在哪儿。我们把英文定价页和中文定价页各拉了一遍,两页的写法不一样,指的是同一段时间。
英文页写的是 UTC 口径:峰时为 01:00–04:00 与 06:00–10:00,其余时段为谷时。中文页写的是北京时间口径:峰时为 09:00–12:00 与 14:00–18:00,其余为谷时。折算一遍:01:00 UTC 对应北京 09:00,04:00 UTC 对应 12:00,06:00 UTC 对应 14:00,10:00 UTC 对应 18:00。两套写法完全重合,合计每天 7 小时是峰时,剩下 17 小时是谷时。
峰时是工作日白天的两段,中午 12:00 到 14:00 那两个小时是谷时。这个细节在配置定时任务的时候有用:很多人默认「白天都贵」,于是把任务一律推到半夜,结果是运营第二天早上才拿到结果。事实上午休那两小时是谷时。
人民币口径的官方数字同日实拉如下,照录官方原单位(元每百万 token):V4-Pro 输入峰 ¥9.0 / 谷 ¥4.5,输出峰 ¥27.0 / 谷 ¥13.5,缓存命中峰 ¥0.30 / 谷 ¥0.15;V4-Flash 输入峰 ¥3.0 / 谷 ¥1.5,输出峰 ¥9.0 / 谷 ¥4.5,缓存命中峰 ¥0.10 / 谷 ¥0.05。这一组不与前面的美元表混算,只用于对着人民币账单核对。
把任务挪出峰时,四步:
- 1列出所有会自己发起调用的东西。 不是列你用的产品,是列「不需要人点一下就会跑起来」的那些:cron 定时任务、工作流平台里的排程、日报周报的生成、批量翻译、批量打标、夜间跑的对账。人手点一下才动的,这一步不收。
- 2给每一条标两个字段:它跑在几点,它的结果几点要被人看到。 这两个字段决定了这条任务有没有挪动空间。日报如果是早上九点看,它可以在凌晨两点跑;客服实时回复的那条链路,没有挪动空间,直接标「不动」。
- 3把有空间的那些排进 18:00 到次日 09:00,或者中午 12:00 到 14:00。 排的时候错开,别让二十条任务全压在 00:00 那一分钟——同一时刻发起的并发会撞限速,省下来的钱会被重试吃掉。
- 4改完之后等一个完整的账期,再拉一次账单按模型和时段对。 不看单次调用日志,看账期总额。挪了没生效的情况是有的:有的排程平台跑的是服务器本地时区,不是你以为的北京时间。
第 4 步是这四步里唯一不能跳的。前三步是改配置,第 4 步才是验收。
四、代价:什么时候不该错峰,以及这件事帮不了谁
先把这套动作的适用边界写清楚。
它只对「结果可以晚一点拿到」的任务成立。峰谷差价换来的是延迟:一条本来上午十点就出结果的批量任务,挪到凌晨跑,意味着这条链路上所有依赖它的人,都要接受结果在第二天早上才到位。如果你的业务是客服实时应答、是用户点一下就要看到回复的对话框、是下单后立刻生成的文案,这一节的全部内容对你都不适用——那些调用发生在用户在线的时候,用户什么时候来,你就什么时候付峰时价。
它也不适合当成谈判筹码去逼自己换供应商。这次调整之后,同一个模型的谷时价仍是它自己峰时价的一半,而横向换供应商要重新过一遍效果验证、提示词适配、失败率观测,这几项的人力成本通常比一个月的账单差额大。换不换是另一个问题,需要另一套数据支撑,不在这张表能回答的范围内。
还有一种情况是挪了也白挪:你的成本大头根本不在这个模型上。先拉账单,看这条链路占总额的百分之几。如果它只占一成,把它砍掉一半,总额只动了 5%,而你为此改了二十处排程配置、引入了二十个新的失败点。这种时候正确的动作是先去看那占九成的另一条链路。
第四种情况,是这套动作会把一个更该修的问题掩盖掉。如果一条链路的账单在两个月里翻了三倍,而供应商的价格表没动过,那涨的是你的调用量或者你的上下文长度,不是单价。这时候把任务挪到谷时,账单会降下来一点,于是没有人再去查那条链路为什么开始吃更多 token。错峰是一个乘数上的动作,它改的是每个 token 的单价;调用量和上下文长度是另一个乘数,两者不能互相替代。我们的写法是:先确认单价没变、量在涨,还是单价在变、量没动——这两句话对应的修法完全不同。
最后留一个提醒,关于本文这些数字本身。价格页是会改的,本文的采集日是 2026 年 8 月 18 日,旧价快照的时点是 2026 年 8 月 15 日 11:10 UTC。任何一篇文章里的价格都只是那一天的切片,做采购决策之前,自己打开官方定价页再拉一次——这件事花不了三分钟,而它是这篇文章里唯一一个我们没法替你做的动作。
关于横向的价格带怎么读、以及一张真实的月度 AI 账单由哪几块构成,站内另有两篇专门写过,与本篇不重叠。
本文事实来源
可自行复核- 1
DeepSeek 官方:V4-Pro 正式版发布公告,含 API 价格调整与「新价自 2026 年 8 月 16 日 16:00 UTC 生效」「非高峰费率比高峰低 50%」原文,以及 V4-Pro / V4-Flash 新增 `reasoning_effort` 三档。
- 2
DeepSeek 官方:Models & Pricing 英文页,调价后价格(V4-Flash 缓存命中 $0.007/$0.014、未命中 $0.22/$0.44、输出 $0.66/$1.32;V4-Pro 缓存命中 $0.022/$0.044、未命中 $0.66/$1.32、输出 $1.98/$3.96),峰时为 UTC 01:00–04:00 与 06:00–10:00。
- 3
DeepSeek 官方:模型与价格中文页,人民币口径与北京时间峰谷时段(峰时 09:00–12:00、14:00–18:00)。
- 4
互联网档案馆存档:调价生效前的同一个官方定价页(V4-Flash $0.0028 / $0.14 / $0.28;V4-Pro $0.003625 / $0.435 / $0.87),抓取时点 2026 年 8 月 15 日 11:10 UTC。
- 5
第一财经:DeepSeek 调价后整体为原价的 1.5 至 12 倍。
- 6
OpenRouter 周榜(按 prompt 与 completion token 合计,数据截至 2026 年 8 月 17 日):deepseek-v4-flash-0731 周量 11.30T 居首,deepseek-v4-pro-0813 周量 0.80T 列第 18。
该榜只反映通过 OpenRouter 调用的那部分需求,且为前 20 名之间的相对量,不代表全平台份额,也不用于判断模型优劣。
