DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.
上下文視窗
1M
最大輸出 Token
384K
發布日期
2026-04-24
能力
函式呼叫提示快取
可用供應商
DeepSeekAzureAliyun
支援的協定
openaianthropic
供应商
Aliyun
輸入 Token
$0.14/M
輸出 Token
$0.28/M
快取讀取
$0.028/M
快取寫入
$0.175/M
網路搜尋
$0.01/R
接入协议
anthropic
Azure
輸入 Token
$0.19/M
輸出 Token
$0.51/M
快取讀取
$0.19/M
網路搜尋
$0.035/R
接入协议
openai
/v1/chat/completions/v1/responsesanthropic
DeepSeek
輸入 Token
$0.14/M
輸出 Token
$0.28/M
快取讀取
$0.0028/M
接入协议
openai
/v1/chat/completionsanthropic
程式碼範例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
運行狀態
第三方評測
LMArena ↗評測條目:deepseek-v4-flash
DeepSeek V4 Flash 在 LMArena 文字榜單(風格控制) 綜合類別中獲得 1438 分,在 374 個模型中排名第 70,基於 41,568 次人類偏好投票(更新於 2026-07-12)。
| 類別 | Arena 分數 | 95% 信賴區間 | 排名 | 投票數 |
|---|---|---|---|---|
| 綜合 | 1433–1442 | 第 70 / 374 名 | 41,568 | |
| 困難任務 | 1455–1466 | 第 65 / 374 名 | 27,503 | |
| 程式設計 | 1476–1489 | 第 71 / 369 名 | 12,085 | |
| 數學 | 1414–1441 | 第 78 / 362 名 | 2,133 | |
| 創意寫作 | 1401–1418 | 第 65 / 372 名 | 6,649 | |
| 指令遵循 | 1423–1436 | 第 66 / 374 名 | 13,952 | |
| 中文 | 1460–1489 | 第 73 / 344 名 | 2,014 |
來源:LMArena · CC BY 4.0 · 更新於 2026-07-12 · 評測方法 ↗ · 排名為 LMArena 文字榜單(風格控制) 各類別內的比較,分數來自第三方人類偏好評測,並非 OFOX 官方評分。
相關模型
常見問題
DeepSeek V4 Flash 在 Ofox.ai 上的價格為輸入 $0.14/M/百萬 Token,輸出 $0.28/M/百萬 Token。按量計費,無月費。
DeepSeek V4 Flash 支援 1M Token 的上下文視窗,最大輸出 384K Token,可處理大型文件並維持長對話。
只需將 base URL 設定為 https://api.ofox.ai/v1,並使用你的 Ofox API Key。API 相容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
DeepSeek V4 Flash 支援以下能力:函式呼叫, 提示快取。透過 Ofox.ai 統一 API 存取所有功能。