DeepSeek API 涨价:最高 12 倍,峰谷时段全解(2026)

DeepSeek 新价 2026-08-16 16:00 UTC 生效。V4 Pro 缓存命中涨 12.1 倍,Flash 输出涨 4.7 倍。峰谷时段、新价表与月账单实算。

DeepSeek API 涨价:最高 12 倍,峰谷时段全解(2026)

DeepSeek 新价已于 2026-08-16 16:00 UTC 生效,而且不是简单的按比例涨。 V4 全系改成了峰谷两档计价,同一个调用现在有两个价格,取决于它落在哪个小时。

新价表里没有任何一档低于旧的统一价。涨得最狠的那一档,恰恰是过去几乎不要钱的那一档。

生效时刻:        2026-08-16 16:00 UTC(=北京时间 2026-08-17 00:00)
计价方式:        峰时 / 谷时两档,谷价是峰价的一半
峰时窗口:        UTC 01:00-04:00 与 06:00-10:00,每天 7 小时
V4 Flash 峰价:   缓存命中 $0.014 / 未命中 $0.44 / 输出 $1.32,每百万 token
V4 Flash 谷价:   $0.007 / $0.22 / $0.66
V4 Pro 峰价:     $0.044 / $1.32 / $3.96
V4 Pro 谷价:     $0.022 / $0.66 / $1.98
涨幅最大:        V4 Pro 缓存命中,峰时 12.1 倍
涨幅最小:        V4 Pro 缓存未命中,谷时 1.5 倍
没变的:          1M 上下文、384K 最大输出、并发 2,500 / 500

DeepSeek 这次到底改了什么?

把每档一个价改成了两个价,而且两个都往上抬。 变的是机制,不只是数字。2026-08-16 之前,deepseek/deepseek-v4-flash 的缓存未命中不管哪天哪个小时都是每百万 token $0.14;现在按请求落点是 $0.22 或 $0.44。

下面是官方定价页的完整新价,对照生效前的旧价。

每百万 token旧统一价新谷价新峰价
V4 Flash 缓存命中$0.0028$0.007$0.014
V4 Flash 缓存未命中$0.14$0.22$0.44
V4 Flash 输出$0.28$0.66$1.32
V4 Pro 缓存命中$0.003625$0.022$0.044
V4 Pro 缓存未命中$0.435$0.66$1.32
V4 Pro 输出$0.87$1.98$3.96

旧价是我们自己在同一个页面上取的快照,Flash 取于 2026-08-06、Pro 取于 2026-08-13,当时分别发在涨价前的 6 个省钱杠杆V4 Pro 0813 两篇里。

页面上其他东西都没动。模型 ID 仍是 deepseek-v4-flashdeepseek-v4-pro、没有后缀,三种协议在两个模型上都能用,扣费规则也照旧:token 数乘单价,优先扣赠送余额。

倒是少了一样东西。从 2026-08-06 起页面上一直挂着一条脚注,预告会有大幅涨价但不给金额也不给日期。那条脚注现在没了,位置换成了解释谷时价的说明。

新价是什么时候开始生效的?

2026-08-16 16:00 UTC,也就是北京时间 2026-08-17 00:00。 这两个说法指的是同一时刻。如果你看到过两个不同的日期,原因就在这里。

英文更新日志写的是新价 “take effect at 16:00 (UTC Time) on August 16, 2026”,中文更新日志同一条写的是「北京时间 2026 年 8 月 17 日 0 时」。北京是 UTC+8,17 日 0 点换算过去正是 16 日的 16:00 UTC。

这个差异真的把人绕进去了。2026-08-15 有人在 r/DeepSeek 上发帖问为什么模型已经变贵了,「明明写着 8 月 17 日才生效」,他引的是中文通知,而他所在时区当时还是 15 日。

公告本身提前三天就发了,在 2026-08-13 那条更新日志里,同一条还宣布了 V4 Pro 正式版。

峰时换算到你所在的时区是几点?

峰时是 UTC 01:00-04:00 和 06:00-10:00,每天 7 小时,而它疼不疼完全取决于你在哪儿。 官方英文页给的是 UTC,中文页给的是北京时间,都不是多数读者实际工作的时区。

本地时区(2026 年 8 月)峰窗 1峰窗 209:00-18:00 工作时段内的峰时小时数
北京、新加坡(UTC+8)09:00-12:0014:00-18:009 小时里 7 小时
东京、首尔(UTC+9)10:00-13:0015:00-19:006 小时
印度(UTC+5:30)06:30-09:3011:30-15:304.5 小时
柏林、巴黎(UTC+2,夏令时)03:00-06:0008:00-12:003 小时
伦敦(UTC+1,夏令时)02:00-05:0007:00-11:002 小时
纽约(UTC-4,夏令时)前一天 21:00-00:0002:00-06:000 小时
旧金山(UTC-7,夏令时)前一天 18:00-21:0023:00-03:000 小时

峰窗对齐的是中国的工作日,对一项削峰填谷的措施来说这很正常。深圳的团队 9 个工作小时里有 7 个撞在峰时,加州的团队一个都撞不上,除非它跑通宵批处理。

2026-08-14 有位太平洋时区的 r/DeepSeek 用户自己把这笔账算了一遍,帖子标题就叫「有时候待在 PST 真爽」。

按这张表排任务之前,有两点要注意:

  • 上表用的是北半球夏令时。 冬令时一到,伦敦和柏林各自会多撞进一小时峰时;美国那两个时区无论夏令时冬令时都躲得开工作时间。
  • 官方没写按哪个时间点计费。 一个 UTC 09:55 开始、跑过 10:00 的会话该算哪一档,目前是未知数。去实测,别猜。

到底涨了多少倍?

1.5 倍到 12.1 倍,取决于模型、档位和小时。 没有单一倍数可言,所以你会看到有人说「涨了 50%」、也有人说「涨了 10 倍」,而他们各自对自己的负载都说得没错。

档位谷价 / 旧价峰价 / 旧价
V4 Flash 缓存命中2.5 倍5.0 倍
V4 Flash 缓存未命中1.6 倍3.1 倍
V4 Flash 输出2.4 倍4.7 倍
V4 Pro 缓存命中6.1 倍12.1 倍
V4 Pro 缓存未命中1.5 倍3.0 倍
V4 Pro 输出2.3 倍4.6 倍

12.1 倍出在 V4 Pro 缓存命中,从每百万 $0.003625 涨到峰时 $0.044。这是全表最大的一跳,也是为什么那一周 r/DeepSeek 上吵得最凶的一帖(发于 2026-08-14,赞同率至今只有 0.69)争的是缓存价,不是输出价。

缓存未命中本来就是最贵的一档,这次涨得最少;缓存命中本来接近免费,这次涨得最多。也就是说,你自己的涨幅是缓存命中率的函数,而且方向和多数人的直觉相反。

为什么缓存命中涨得最狠?

因为不正常的是旧的缓存价,不是新的。 每百万 $0.0028 的时候,V4 Flash 一次缓存命中比未命中便宜 50 倍;到了 $0.014 是便宜 31 倍。两个比值都很激进,旧的那个是离谱。

这个比值正是 DeepSeek 在 agent 场景里成本故事的全部依据。agent 循环每一轮都要重发同样的系统提示和同样的文件内容,命中率超过 90% 是常态。在旧价表下,一个 90% 命中的负载几乎不用为输入付钱。

所以你今天的缓存命中率越高,这次涨幅就越大。同一个模型、同样的用量,两种命中率:

  • 命中率 40%,上下文大多是新的:谷时 1.7 倍,峰时 3.4 倍
  • 命中率 90%,典型 agent 循环:谷时 2.1 倍,峰时 4.1 倍

缓存仍然值得用,缓存配置指南也一个字都不用改,因为 DeepSeek 的缓存是自动的。它只是不再是那个能让账单消失的杠杆了。

谷价是打折,还是只是涨得少一点?

只是涨得少一点。 定价页脚注写的是「谷时价格为峰时价格的一半」,这句话本身没错,读起来也像折扣。但它比的是新的峰价,不是你上周付的价。

拿旧的统一价对照:V4 Flash 输出的谷价是 $0.66,旧价 $0.28。就算在便宜的那半天里,也贵了 2.4 倍。一天当中没有任何一个小时,两个模型的任何一档,还是 2026-08-15 那个价。

措辞值得较真,是因为 DeepSeek 以前用同一套机制做过真折扣,下面会讲。2025 年的谷时意味着比标价便宜,2026 年的谷时意味着先把标价抬上去,再收你一半。

换算到真实月账单是多少?

典型 agent 负载大约谷时 2 倍、峰时 4 倍。 下面按 V4 Flash 算一个月:输入 3 亿 token、缓存命中率 90%,输出 2000 万 token。这个形状对一个基本天天跑的编码 agent 来说很普通。

场景缓存命中缓存未命中输出合计
旧统一价$0.76$4.20$5.60$10.56
新价,全谷时$1.89$6.60$13.20$21.69
新价,全峰时$3.78$13.20$26.40$43.38
DeepInfra,不分时段$4.32$2.40$3.60$10.32

这张表能读出三件事:

  • 输出已经成了账单里的大头,占谷时账单的 61%,以前是 53%。你没法缓存的那一档,正是你现在真正在付钱的那一档。
  • 全谷时那一栏是美国或欧洲团队的地板价,而它仍然是旧账单的大约两倍。
  • 一家不分时段的第三方托管商,现在的账单已经低于 DeepSeek 自己涨价前的价。
  • 同样一个月,命中率换成 40%:旧价 $31.14、谷时 $53.64、峰时 $107.28。账单更高,倍数更低,出自同一张表。

第三方托管商现在更便宜了吗?

V4 Flash 上几乎全都更便宜,V4 Pro 上没有一家能压过官方谷价。 两个模型走到了完全相反的位置,原因是各自权重公开了多久。

2026-08-17 07:15 UTC(正处在峰窗内)拉 OpenRouter 端点接口,V4 Flash 0731 有 28 条 listing:

托管商输入输出缓存读上下文量化
DeepInfra$0.08$0.18$0.0161Mfp8
DigitalOcean$0.08$0.252$0.02521M未标
GMICloud$0.084$0.168$0.01681Mfp8
BaseTen$0.13$0.26$0.0281Mfp8
Fireworks、Novita、Together 等$0.14$0.28$0.0281M混合
Cloudflare$0.44$1.32$0.0141.28M未标
DeepSeek$0.44$1.32$0.0141Mfp8

在这份原本由它定锚的名单上,DeepSeek 现在是并列最贵的输入价。Cloudflare 与它逐分同价,这是转售源端点的典型样子。其余所有自己跑开源权重的托管商,价格都在它的三分之一到五分之一。

这些 listing 里任一时刻都有两到三条处于降权或离线状态,而且是哪几条会随时间变。OpenRouter 按端点把这个状态暴露出来了,路由的时候自己看一眼,别信任何人早前发的表。

Flash 上 DeepSeek 还赢着一列:缓存读,峰时 $0.014、谷时 $0.007,对 DeepInfra 的 $0.016。8 月初这一项的对照是 $0.0028 对 $0.018,优势 6.4 倍;现在只剩 1.14 倍,已经扛不动表里其余各列了。

  • 只算输入的盈亏平衡点:谷时要 94% 缓存命中率,峰时要 99.4%。 低于这个命中率第三方更便宜。涨价前同一算法给出的是 77%。
  • 只要有任何输出量,DeepInfra 就直接赢,因为它的输出价比官方谷价还低 3.7 倍。

V4 Pro 0813 是镜像。同一个早上它有九条 listing,2026-08-14 时还只有三条,因为它的权重 2026-08-13 才公开。其中最便宜的 Novita 是输入 $1.056 / 输出 $3.168,仍高于 deepseek/deepseek-v4-pro 的谷价 $0.66 / $1.98。

但拿官方峰价来比,Pro 这边又翻过来了:命中率低于 53% 时 Novita 赢,低于 64% 时 GMICloud 赢。

走第三方这条路有两点要说清:

  • 你买到的不一定是同一个模型。 好几家便宜的 Flash 端点跑的是 fp4 量化,或者把上下文砍到 262K,而且没有一家复刻了 DeepSeek 自己的缓存栈。
  • 上次发版那个 slug 陷阱依然有效。 不带 -0731 后缀的 deepseek/deepseek-v4-flash 是四月的旧版。

DeepSeek 以前改过计价方式吗?

十八个月里改了三次,而这是第一次用时段来多收钱,而不是少收。 机制对 DeepSeek 来说不新鲜,新鲜的是方向。

日期变化方向
2025-02-26上线谷时折扣,每天 UTC 16:30-00:30,V3 打 5 折、R1 打 2.5 折
2025-09-05新价生效,谷时折扣结束
2026-08-16改峰谷计价,谷价定为峰价的一半

2025 年那条公告现在还挂在网上,今天再读措辞很不一样:「Starting today, enjoy off-peak discounts on the DeepSeek API Platform from 16:30–00:30 UTC daily.」

那个时段窗口整段落在今天所谓的谷时里。当年 DeepSeek 打折的那几个小时,如今只是它不加价的几个小时。2025 年那次变更和这次都在 16:00 UTC 生效,如果你在盯下一次,这一点值得记住。

供应商改价的时候,怎么才能不用换 key?

把工具指向一个不绑死单一供应商的端点。 上面每一条路都把 base URL、API key 和计费关系押在了一家公司的定价决策上,而这一周恰好演示了这种决策能有多快。

三条路各有各的坏法。直连 DeepSeek,等于把自己绑在按中国工作日排的峰窗和一个充值余额上。走第三方 Flash 托管商,单价更便宜,但换来的是不同的量化、有时更短的上下文,而且每多一个故障转移目标就要多配一把 key。什么都不动,那就是下一条更新日志写什么你付什么。

三条路都讲 OpenAI 兼容 HTTP,所以解法在哪条路上都一样:把 base URL 和 key 固定住,让模型字符串成为唯一会变的东西。在 ofox 上这两个字符串是 deepseek/deepseek-v4-flashdeepseek/deepseek-v4-pro,所以把负载挪出 DeepSeek 是改一行字符串,不是做一次迁移。

价格上这么做能买到什么、买不到什么,得说清楚。ofox 对两个模型都按 DeepSeek 的新峰价单档收费:Flash 输入 $0.44 / 输出 $1.32,Pro $1.32 / $3.96,缓存读分别是 $0.014 和 $0.044,没有谷时档。

所以如果你的团队本来就躲得开峰窗、而且只调一个模型,那些小时里直连 DeepSeek 更便宜,就该直连。网关真正派上用场,是你想拿 Flash 和某家第三方对比、或者和 DeepSeek 家族之外的模型对比,又不想为此开三个账号的时候。

如果你用的是 DeepSeek 自家的 agent 工具,同一套替换也成立:DeepSeek Harness 配置指南讲了怎么把 dsh 指向任意 OpenAI 兼容的服务商,r/DeepSeek 那几个帖子里就有不少人是这样在不换工具的前提下离开官方端点的。

顺着这张新价表往下做决策,有三篇比本文更深:6 个省钱杠杆讲怎么省,V4 Pro vs Flash讲选哪个模型,DeepSeek API 定价指南讲开户和拿 key。

References

常见问题

DeepSeek 这次涨价,V4 Flash 和 V4 Pro 幅度一样吗?
不一样,每一档的倍数都不同。V4 Flash 缓存命中从 $0.0028 涨到峰时 $0.014,5 倍;V4 Pro 缓存命中从 $0.003625 涨到峰时 $0.044,12.1 倍。两个模型涨幅最小的都是缓存未命中,峰时约 3 倍。输出价两个模型都落在 4.5 到 4.7 倍之间。
峰谷价按请求发起时间算还是完成时间算?
官方没写。定价页只给了峰时窗口和扣费规则(token 数乘单价),对跨越边界的请求按哪个时间点计费只字未提。如果你的 agent 会话经常跨过 UTC 04:00 或 10:00,把这个口径当未知量,用自己的账单去实测,别假设。
Anthropic 协议端点也涨吗?
涨。价格按模型算不按协议算,api.deepseek.com 和 api.deepseek.com/anthropic 走同一张价表,两个模型现在也都支持 Responses API 格式。
第三方托管商现在比 DeepSeek 官方便宜了吗?
V4 Flash 上几乎全都便宜。2026-08-17 拉 OpenRouter 端点接口,28 条 listing 里 26 条的输入价低于官方峰价 $0.44,最低的 DeepInfra 是输入 $0.08 / 输出 $0.18。唯一持平 $0.44 的是 Cloudflare,它与官方逐分同价。V4 Pro 上正相反:官方谷价 $0.66 比九条 listing 全都便宜。
涨价之后还值得开缓存吗?
值得,但省得比以前少。同一时段内 V4 Flash 缓存命中仍比未命中便宜约 31 倍(峰时 $0.014 对 $0.44),以前这个比值是 50 倍。缓存从决定账单的主杠杆,变成了几个杠杆之一。
涨价前充的余额还能按旧价用吗?
更新日志和定价页都没有这样的说法。扣费规则没变:费用等于 token 数乘当时生效的单价,优先扣赠送余额。按新价来算你的存量余额。
旧的 $0.0028 缓存命中价还在吗?
没了。V4 Flash 缓存命中现在是谷时 $0.007、峰时 $0.014,也就是说新价里便宜的那一半也已经是旧价的 2.5 倍。任何还写着每百万 $0.0028 缓存价的页面,都是 2026-08-16 之前的快照,不管是谁发的。