MiMo 2.6 多少钱?Pro、Flash 与 UltraSpeed 怎么选
按型号、币种和缓存状态核对 MiMo 2.6 API 价格,分清 Batch、Token Plan 与普通按量计费,再计算实际任务成本。
MiMo 2.6 的费用取决于精确型号和计费路径。普通 Pro、Flash 与 Pro UltraSpeed 不能混用:官方公布的 UltraSpeed 各项 token 费率是普通 Pro 的十倍。看到价格截图时,先看完整 ID,再判断是否涨价。
下表依据 2026 年 9 月 22 日核对的小米官方按量价表,不是 Ofox 报价、网关优惠或桌面会员价格。
海外 API 美元费率
| API 模型 ID | 未缓存输入/百万 token | 缓存输入/百万 token | 输出/百万 token |
|---|---|---|---|
mimo-v2.6-flash | $0.14 | $0.0028 | $0.28 |
mimo-v2.6-pro | $0.435 | $0.0036 | $0.87 |
mimo-v2.6-pro-ultraspeed | $4.35 | $0.036 | $8.70 |
来源:小米 MiMo API 定价。UltraSpeed 有单独的接入安排,价表列出型号不等于你的账号已经开通。
中国区 API 人民币费率
| 型号 | 未缓存输入/百万 token | 缓存输入/百万 token | 输出/百万 token |
|---|---|---|---|
| Flash | ¥1 | ¥0.02 | ¥2 |
| Pro | ¥3 | ¥0.025 | ¥6 |
| Pro UltraSpeed | ¥30 | ¥0.25 | ¥60 |
这是服务商分别公布的币种价表,不是本文按汇率折算。应使用账户实际适用的地域和币种,不能把人民币输入价格与美元输出价格放在一起计算。
命中缓存能改变多少费用?
假设海外标准 Pro 的一次请求包含 20,000 个未缓存输入 token、80,000 个缓存输入 token,以及 5,000 个计费输出 token:
未缓存输入:20,000 / 1,000,000 × $0.435 = $0.00870
缓存输入: 80,000 / 1,000,000 × $0.0036 = $0.000288
输出: 5,000 / 1,000,000 × $0.87 = $0.00435
token 费用合计: $0.013338
这是计算示例,不是实测账单。总输入不变但完全未命中缓存时,token 费用为 $0.04785。真实请求必须使用返回的用量,重复提示词不保证缓存命中。
如果总输入字段已包含缓存部分,要先减去缓存输入再算普通输入费。输出也要包含实际计费的推理,而不只是聊天窗口显示的答案。工具与重试还可能让完整任务费用高于单次请求。
Batch、搜索和 Token Plan 分开计算
官方 Batch 文档说明,受支持的 Pro/Flash 批量处理按实时费率的 50% 计费,不包含 UltraSpeed。Batch 走 API 现金余额,不消耗 Token Plan 配额,Base URL 应使用控制台提供的地址。
定价页还单列联网搜索费用,并注明缓存写入限时免费。这些规则各有适用范围,不能写成所有工具免费附送,也不能把临时条件当作永久承诺。
Token Plan 与普通余额属于不同的计费系统。购买前检查 Key 类型、接口、可用模型和扣减方式。尚未弄清扣减规则时,一个很大的宣传配额数字不能直接与 token 总量比较。
应先评估哪个版本?
先选一个有明确完成条件的典型任务。Flash 的公开单价更低,可以作为起点;如果任务需要不同的推理能力,再单独评估标准 Pro。只有权限和延迟需求匹配时,才考虑 UltraSpeed。吞吐更高不等于完成任务的总成本更低。
Agent 应记录每次请求、缓存、计费输出、重试和工具费,也记录最终是否验收通过。一次便宜的失败,不能当作经济有效的方案。
入口指南区分 OpenCode Free、Desktop 和直接 API;接入指南介绍测用量前如何匹配 Key 与 endpoint。
常见问题
- UltraSpeed 和普通 Pro 同价吗?
- 不同。官方公布的 UltraSpeed token 费率是普通 Pro 对应费率的十倍。
- Batch 能扣 Token Plan 配额吗?
- 官方 Batch 文档使用 API 现金余额路径,不抵扣 Token Plan 配额。


