DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.
上下文窗口
1M
最大输出 Token
384K
发布日期
2026-04-24
能力
函数调用提示缓存
可用供应商
DeepSeekAzureAliyun
支持的协议
openaianthropic
供应商
Aliyun
输入 Token
$0.14/M
输出 Token
$0.28/M
缓存读取
$0.028/M
缓存写入
$0.175/M
网络搜索
$0.01/R
接入协议
anthropic
Azure
输入 Token
$0.19/M
输出 Token
$0.51/M
缓存读取
$0.19/M
网络搜索
$0.035/R
接入协议
openai
/v1/chat/completions/v1/responsesanthropic
DeepSeek
输入 Token
$0.14/M
输出 Token
$0.28/M
缓存读取
$0.0028/M
接入协议
openai
/v1/chat/completionsanthropic
代码示例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
运行状态
第三方评测
LMArena ↗评测条目:deepseek-v4-flash
DeepSeek V4 Flash 在 LMArena 文本榜单(风格控制) 综合类别中获得 1438 分,在 374 个模型中排名第 70,基于 41,568 次人类偏好投票(更新于 2026-07-12)。
| 类别 | Arena 分数 | 95% 置信区间 | 排名 | 投票数 |
|---|---|---|---|---|
| 综合 | 1433–1442 | 第 70 / 374 名 | 41,568 | |
| 困难任务 | 1455–1466 | 第 65 / 374 名 | 27,503 | |
| 编程 | 1476–1489 | 第 71 / 369 名 | 12,085 | |
| 数学 | 1414–1441 | 第 78 / 362 名 | 2,133 | |
| 创意写作 | 1401–1418 | 第 65 / 372 名 | 6,649 | |
| 指令遵循 | 1423–1436 | 第 66 / 374 名 | 13,952 | |
| 中文 | 1460–1489 | 第 73 / 344 名 | 2,014 |
来源:LMArena · CC BY 4.0 · 更新于 2026-07-12 · 评测方法 ↗ · 排名为 LMArena 文本榜单(风格控制) 各类别内的比较,分数来自第三方人类偏好评测,并非 OFOX 官方评分。
相关模型
常见问题
DeepSeek V4 Flash 在 Ofox.ai 上的价格为输入 $0.14/M/百万 Token,输出 $0.28/M/百万 Token。按量计费,无月费。
DeepSeek V4 Flash 支持 1M Token 的上下文窗口,最大输出 384K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.ai/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
DeepSeek V4 Flash 支持以下能力:函数调用, 提示缓存。通过 Ofox.ai 统一 API 访问所有功能。