DeepSeek V4.1 Flash API 多少钱?缓存和峰谷费用怎么算

核对 DeepSeek V4.1 Flash API 美元费率,区分缓存命中、未命中和输出费用,查看高峰时段及预算算例,再决定充值多少。

灰粉色背景,浅色纸面上的算盘黑色墨线图,搭配几何点缀和 DeepSeek V4.1 Flash 标题。

DeepSeek V4.1 Flash 有三类 token 价格:缓存输入、非缓存输入和输出。 官方 API 还按时段采用不同费率。估算预算前,先确定模型、计费供应商和实际任务用量,不要直接把全部 token 乘以宣传中的最低单价。

以下费率于 2026 年 9 月 10 日对照 DeepSeek 官方定价页核查,适用于直连 DeepSeek API,以美元计价,不是 Ofox 或其他网关的报价。本文没有发起付费请求,也未实测账户扣费。

每百万 token 的官方价格

token 类别低峰美元价格/百万 token高峰美元价格/百万 token
缓存命中输入$0.003$0.006
缓存未命中输入$0.15$0.30
输出$0.60$1.20

定价对应的模型是 deepseek-flash,目前为 V4.1 Flash。如果仍在请求中使用 V4 时期的名称,先看发布与别名说明,再判断旧价表是否适用。Pro 在 9 月 14 日的变化另有迁移清单

不要把缓存命中价格套到全部输入上。重复发送同一条指令,本身不能证明整个请求都按缓存命中计费。应查看返回的用量字段和供应商账单记录。

哪些时间按高峰价收费?

官方高峰时段为周一至周五 UTC 01:00–04:00 和 06:00–10:00,其余时间为低峰。同一时段换算为北京时间是 09:00–12:00 和 14:00–18:00;东京、首尔时间为 10:00–13:00 和 15:00–19:00。

所在地有夏令时时,应使用能够处理时区变化的转换方式。不能把一套固定本地时间写成全球通用安排。请求跨越计价时段边界时,应核对供应商规则与实际账单,不要自行编造拆分计费公式。

用一个请求算例估算预算

假设有一组刻意简化的任务:共 100 次请求,每次包含 10,000 个非缓存输入 token 和 2,000 个计费输出 token。合计为 100 万非缓存输入 token 和 20 万输出 token。

Off-peak: (1 × $0.15) + (0.2 × $0.60) = $0.27
Peak:     (1 × $0.30) + (0.2 × $1.20) = $0.54

Off-peak 为低峰,Peak 为高峰。以上是在明确假设下做的算术,不是实测 Agent 平均成本。如果 Agent 会多次调用模型、重试、累积对话历史,或生成更多计费输出,就应替换成实际总量。不能只按最终答案可见文字的长度估算费用。

输入混有缓存命中和未命中部分时,可使用:

Cost = cached_input_tokens / 1_000_000 × cached_input_rate
     + uncached_input_tokens / 1_000_000 × uncached_input_rate
     + billed_output_tokens / 1_000_000 × output_rate

也就是把缓存输入、非缓存输入和计费输出分别乘以对应费率,再相加。

沿用同一算例,5 美元 token 预算在低峰约能容纳 18 个完整的 100 次请求批次,高峰则是 9 个。这里没有计入供应商特有费用,并假设每批的 100 次请求都满足上述 token 预算;不代表充值 5 美元就一定能完成 1,800 个有用任务。

比供应商时,看完成整个任务花多少钱

充值前,记录实际模型 ID、支持的操作、展示费率和支付条件。供应商的 ID、计费单位或路由政策可能与官方端点不同。自行换算汇率,也不等于拿到了供应商以本币开出的报价。

对编程 Agent,应比较完成同一个小任务的总费用,包括修正所需的后续轮次。Codex 配置Claude Code 配置说明了配置怎样影响实际接收任务的模型。主模型选得更便宜,不能说明每个辅助任务或子代理也使用同一个模型。

准备评估 Ofox 时,先查目录与路由价格,确认所需模型和操作受支持,再创建账户。从符合该供应商计费条件的小任务预算开始。在其他平台注册或充值,不会增加直连 DeepSeek 账户的余额。

第一次调用后,还要核对什么?

API 接入教程发起最小请求,保存脱敏后的用量汇总、型号、供应商、时间和扣费金额。安排批量任务前,先用这份记录核对公式。仍有差异时,分别检查缓存分类、输出用量、调用次数、时段与供应商自身的定价,不要把算术表当作账单保证。

决定在哪个平台充值前,先按API 购买检查清单核对模型、协议与计费条件。

常见问题

DeepSeek V4.1 Flash API 怎么收费?
9 月 10 日官方美元价格中,每百万 token 的低峰费率为:缓存命中输入 0.003 美元、缓存未命中输入 0.15 美元、输出 0.60 美元。高峰价格为以上金额的两倍。
最低输入价适用于所有提示词吗?
不适用。缓存命中和未命中分别计费,要根据请求用量与账单记录确认实际分类。
5 美元能调用多少次?
没有固定次数。每次请求的输入与输出 token、缓存命中、时段和供应商都会影响结果。本文算例用于估算预算,不是调用数量保证。