DeepSeek API 价格:官方峰谷单价,谷时每百万 $0.22

2026-08-18 从官方定价页读到的现价:V4 Flash 谷时每百万输入 $0.22,V4 Pro $0.66,峰时翻倍。含缓存折扣与月账单实算。

DeepSeek API 价格:官方峰谷单价,谷时每百万 $0.22

价格已于 2026-08-18 重新核对。 本页所有 DeepSeek 数字都是当天从官方定价页读到的,也就是 2026-08-16 16:00 UTC 峰谷计价生效之后。想看每一档具体涨了多少倍、为什么这么改,见DeepSeek API 涨价

DeepSeek V4 Flash 谷时每百万输入 $0.22、峰时 $0.44,输出对应 $0.66 和 $1.32。 V4 Pro 在输入和输出这两行都是它的三倍,缓存命中那行还略高于三倍。缓存命中只要未命中的约 3%,是整张账单上最大的一个杠杆。峰时一天 7 小时,落在 UTC 01:00-04:00 和 06:00-10:00,谷时正好半价。 如果你更希望一把 key 打通 DeepSeek、Claude、GPT 和 Gemini,而不是盯着钟表调度任务,ofox.ai 全天按峰价供这两个模型。

八月:充值省 15%,用量再返 15%,填码 OFOXAI2608在 ofox.ai 一键接入 DeepSeek V4,OpenAI 兼容端点。

DeepSeek V4 Flash 是什么?

V4 Flash 是 DeepSeek 现在的走量模型,和能力更强的 V4 Pro 并列在售。两个都是 1M token 上下文窗口,单次最多生成 384K 输出 token。今天在 API 上,deepseek-v4-flash 指向 DeepSeek-V4-Flash-0731,deepseek-v4-pro 指向 DeepSeek-V4-Pro-0813。

V4 Pro 多出来的是多步问题上更深的推理,三倍的 token 价买的就是这个。V4 Flash 处理日常那些活——摘要、分类、对话、常规写代码。两个模型都默认开启思考模式,官方另有一页讲怎么关。

有两个 ID 曾经出现在每一篇 DeepSeek 教程里:deepseek-chatdeepseek-reasoner。截至 2026-08-18,它们已经不在定价页和首次调用页的模型表里了。如果你的代码还在发这两个 ID,值得实测一次,别默认它们还在。

官方 DeepSeek API 价格是多少?

以下都是每百万 token,取自 2026-08-18 的官方定价页。每一行的谷价都正好是峰价的一半。

模型输入(缓存命中)输入(缓存未命中)输出上下文最大输出
deepseek-v4-flash 谷时$0.007$0.22$0.661M384K
deepseek-v4-flash 峰时$0.014$0.44$1.321M384K
deepseek-v4-pro 谷时$0.022$0.66$1.981M384K
deepseek-v4-pro 峰时$0.044$1.32$3.961M384K

峰时是 UTC 01:00-04:00 与 06:00-10:00,一天 7 小时,换算成北京时间是 09:00-12:00 和 14:00-18:00。剩下 17 小时是谷时。机制就这么多:没有档位可选,没有开关可设,峰时也买不到谷价。

真正的钱在缓存那一行。同一档里命中大约只要未命中的 3%,相当于那部分 token 打了 0.3 折,而且只要提示词前缀能对上 DeepSeek 已有的内容就自动生效,不用配置,也没有另一个端点。这一列值得盯着看,是因为生产环境的提示词大多数都是前缀:系统提示、工具 schema、多轮之间不变的那份文档。

有一件事官方没写:一个请求如果从谷时开始、到峰时才结束,按开始还是结束时间计费。如果你的长会话贴着 UTC 04:00 或 10:00 跑,这是未知而不是已知答案。

一个月实际要花多少?

拿一份每月 1000 万输入 token、200 万输出 token 的负载,在 V4 Flash 上按三种情况算。

情况谷时峰时
完全没有缓存$3.52$7.04
输入的 80% 走缓存命中$1.82$3.63
同样的量放在 V4 Pro,无缓存$10.56$21.12

前两行的差距,是「把提示词按稳定前缀组织」这件事值多少钱。两列之间的差距,是「把批量任务挪出那 7 个峰时小时」值多少钱——文档处理、数据集标注这类活本来就可以排期。

换成单次请求的口径:一段 2000 token 的系统提示,如果每次调用都命中缓存,每一百万次请求在谷时省下 $426、峰时省下 $852。在不换模型的前提下,这是你能控制的最大一笔。

怎么拿到 DeepSeek 的 API key?

platform.deepseek.com 用邮箱注册,登录后进 API Keys 生成一把。

base URL 有两个:OpenAI 兼容那条是 https://api.deepseek.com,Anthropic 兼容那条是 https://api.deepseek.com/anthropic,同一把 key 换个 base_url 就能从任一 SDK 调。JSON 输出、工具调用、Responses API 和对话前缀续写两个模型都支持;FIM 补全是 beta,且只在非思考模式下可用。

扣费分充值余额和赠送余额两本账,两者都有时先扣赠送的。文档里没有承诺任何长期免费额度,所以注册送的那点额度按试用看待,别当成方案的一部分。

一个实际的提醒:官方给的是并发上限,不是可用性承诺,也没有公开的状态页可以看。要做生产级的东西,备用线路自己规划,别假设余量。

怎么通过 ofox 调用 DeepSeek?

ofox.ai 上,DeepSeek V4 Flash 的 ID 是 deepseek/deepseek-v4-flash,输入 $0.44、输出 $1.32;DeepSeek V4 Prodeepseek/deepseek-v4-pro,输入 $1.32、输出 $3.96。这就是官方的峰价,全天不变,没有峰谷之分。

这话得说明白,因为它是双向的。在那 17 个谷时小时里,官方直连的花费是走网关的一半。 在 7 个峰时小时里两边一样贵。网关换来的是一把 key 覆盖你用到的每个模型、一张账单,以及官方平台繁忙时有地方可切。如果 DeepSeek 是你唯一调用的模型、任务又都是可排期的批量活,直连更便宜,做成本复盘时该照实说。

还有一个跟缓存有关的细节:同一个模型 ID 背后可能不止一条上游线路,而各条线路的缓存读取价并不一样。V4 Flash 在 DeepSeek 和百炼两条线路上,缓存读取按每百万 $0.014 计;在 Azure 那条线路上按 $0.44 计,也就是和输入同价,等于完全没有缓存折扣。各线路的实时明细在 DeepSeek 模型页上。

实际的好处是一把 API key 同时覆盖 Claude、GPT、Gemini、Qwen,以及 2026-08-18 当天在册的 130 多个模型,不用分别开户、分别付款。如果你会按任务类型或成本在模型之间路由,这一点更明显,AI API 聚合指南讲得更细。想看纯粹的接入教程和三个编程工具的配置参数,另有一篇 DeepSeek V4 API 调用教程

接入是三行:

from openai import OpenAI

client = OpenAI(api_key="sk-xxx", base_url="https://api.ofox.ai/v1")
response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Explain the 1M token context window in one paragraph"}]
)

从 OpenAI SDK 迁过来的话,迁移指南里 10 分钟能换完。

怎么把 DeepSeek 的 API 账单降下来?

缓存折扣仍然是最大的杠杆,而且比以前更大:输入还是 $0.14 的时候,一次命中每百万省 $0.137;现在谷时 $0.22,一次命中省 $0.213。把系统提示和不变的上下文放在最前面,这些是最可能被缓存的部分。不用配置,前缀对上就自动生效。缓存命中率实算那篇讲了为什么真实账单上的命中率通常低于设计预期。

第二个杠杆是新出现的:把不需要立刻跑的东西挪出峰时窗口。 夜间文档处理、数据集标注、批量摘要都可以排期,而谷时每一行都是半价,包括缓存读取。峰时那 7 小时是 UTC 01:00-04:00 和 06:00-10:00,所以这件事对你有多不方便完全取决于你在哪个时区:美洲团队正常工作日几乎碰不到,东亚团队则大半都在里面。

第三个是选模型。只在真正需要更深推理的时候用 deepseek-v4-pro。Pro 在缓存未命中输入和输出这两行都正好是 Flash 的三倍,拿它做分类、摘要和简单生成,等于三倍账单换零收益。

上下文裁剪同样有用。1M 窗口很大,但每一个没命中缓存的输入 token 都要付钱。只取相关片段的 RAG 比把整篇文档塞进去便宜,embedding 与 RAG 指南讲了这个模式。想要跨模型的通用省钱清单,见如何降低 AI API 成本

DeepSeek 和别的模型比,价格怎么样?

下表全部是 2026-08-18 的 ofox 单价,每百万 token,同一个来源,所以 DeepSeek 那两行取的是峰价而不是谷价。

模型输入输出
Qwen Max$0.35$1.38
DeepSeek V4 Flash$0.44$1.32
DeepSeek V4 Pro$1.32$3.96
GLM 5.2$1.40$4.40
Claude Sonnet 5$2$10
Kimi K3$3$15
Claude Opus 5$5$25
GPT-5.6 Sol$5$30

V4 Flash 的输入比 Claude Sonnet 5 便宜 4.5 倍、输出便宜 7.6 倍,输入大约是 Claude Opus 5 和 GPT-5.6 Sol 的十一分之一。但它不是这张表上最便宜的:Qwen Max 的输入比它还低约 20%,只在输出上输一点。谁要是告诉你 DeepSeek 一定是最便宜的那个,多半是有一阵没查了。

代价还是老一套。官方给的是并发上限而不是可用性承诺,复杂英文指令的遵循程度也不及上面那几个前沿模型。想看能力而不是价格的横向对比,见模型对比指南

上量之前该知道哪些限制?

几件不提前知道就会踩的:

  • 并发是按模型分别设上限的,而且两者差得远:V4 Flash 2500 并发,V4 Pro 只有 500。以 Pro 为主的流水线撞墙会早五倍。
  • 速率限制随账户等级变化,新账户起点保守。量测阶段大概率会碰到。
  • 1M token 上下文只算输入。两个模型的最大输出都是 384K。
  • 两个模型都默认开思考模式,定价页把”怎么关”指向了另一份文档,不是一个可以随手猜的请求参数。
  • FIM 补全是 beta,而且两个模型上都只在非思考模式下可用。
  • 价格会变,官方自己在定价页上写着:「产品价格可能发生变化,DeepSeek 保留调整价格的权利。建议按实际用量充值,并定期查看本页获取最新价格信息。」在 2026-08-16 那种幅度的调整之后,这句话不是套话。

结论

谷时每百万输入 $0.22、缓存前缀再省约 97%,V4 Flash 依然是能叫得上号的模型里最便宜的那一档。 八月变的是账单开始看钟:同一个任务落在 UTC 01:00-04:00 或 06:00-10:00 就要贵一倍。把提示词按缓存友好的方式组织,把批量任务挪出那 7 小时,V4 Pro 只留给真正需要它的活。

想看把 DeepSeek V4 当 Claude Code 后端的真实成本分析(含缓存命中率的现实值和质量取舍),见DeepSeek V4 在 Claude Code 里的成本拆解。想知道 V4 Pro 0813 的三倍价钱到底买到了什么,见 V4 Pro 0813 拆解。直接开始可以去 platform.deepseek.com,或者用 ofox.ai 一把 key 同时覆盖 DeepSeek、Claude、GPT 和 Gemini。

References

常见问题

DeepSeek API 现在多少钱?
按每百万 token、谷时价算:V4 Flash 缓存未命中输入 $0.22、缓存命中 $0.007、输出 $0.66;V4 Pro 依次是 $0.66、$0.022、$1.98。峰时每一档都正好是谷时的两倍,也就是 Flash $0.44 / $0.014 / $1.32、Pro $1.32 / $0.044 / $3.96。数据 2026-08-18 读自 api-docs.deepseek.com。
DeepSeek 的峰时是几点?
UTC 01:00-04:00 与 06:00-10:00,一天合计 7 小时;换成北京时间就是 09:00-12:00 和 14:00-18:00。其余 17 小时是谷时,单价是峰时的一半。官方没有写明跨越时段边界的请求按开始还是结束时间计费,所以贴着 UTC 04:00 和 10:00 跑的长会话属于未知。
DeepSeek 的缓存能省多少?
同一档里缓存命中大约是未命中的 3%,也就是输入那一行省掉约 97%。V4 Flash 谷时就是每百万 $0.007 对 $0.22。这个折扣是自动的,只要你的提示词前缀命中了缓存就生效,不需要任何配置。
怎么拿 DeepSeek 的 API key?
在 platform.deepseek.com 用邮箱注册,登录后进 API Keys 生成。也可以走 ofox.ai,用一把 key 同时覆盖 Claude、GPT、Gemini 和 Qwen,不用单独开户。
现在 DeepSeek API 认哪些模型 ID?
deepseek-v4-flash 和 deepseek-v4-pro。截至 2026-08-18,定价页和首次调用页的模型表里只有这两个,分别指向 DeepSeek-V4-Flash-0731 和 DeepSeek-V4-Pro-0813。老的 deepseek-chat 与 deepseek-reasoner 已不在这两个页面上出现。
DeepSeek 有免费额度吗?
没有任何书面承诺的长期免费额度。扣费规则里提到赠送余额会先于充值余额扣减,注册时给的额度就是这么消耗的,但金额和是否发放在定价文档里都没有承诺。
走官方直连便宜还是走网关便宜?
谷时官方直连更便宜,因为网关一般不跟着做峰谷两档。ofox 上 V4 Flash 全天都是输入 $0.44、输出 $1.32,等于官方峰价,也就是谷时的两倍。多花的这部分买到的是一把 key、一张账单,以及官方平台繁忙时的备用线路。