Qwen3 Max 是阿里巴巴于 2026-01-23 发布的最新旗舰 Qwen 模型,通过 Dashscope 提供服务,具备强大的推理能力、长上下文处理能力和增强的编码能力。它支持推理(思维链)、工具调用(function calling)和提示缓存。上下文窗口:256K tokens,输出:64K。通过 OpenAI 兼容协议接入。
上下文窗口
256K
最大输出 Token
64K
发布日期
2026-01-23
能力
函数调用推理提示缓存
可用供应商
Aliyun
支持的协议
openai
供应商
Aliyun
输入 Token
$0.36/M
输出 Token
$1.43/M
缓存读取
$0.072/M
网络搜索
$0.01/R
接入协议
openai
/v1/chat/completions/v1/responses代码示例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3-max",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
第三方评测
LMArena ↗评测条目:qwen3-max-2025-09-23
Qwen3 Max 在 LMArena 文本榜单(风格控制) 综合类别中获得 1424 分,在 374 个模型中排名第 90,基于 9,151 次人类偏好投票(更新于 2026-07-12)。
| 类别 | Arena 分数 | 95% 置信区间 | 排名 | 投票数 |
|---|---|---|---|---|
| 综合 | 1424 | 1418–1431 | 第 90 / 374 名 | 9,151 |
| 困难任务 | 1448 | 1439–1456 | 第 82 / 374 名 | 4,868 |
| 编程 | 1474 | 1461–1487 | 第 82 / 369 名 | 2,041 |
| 数学 | 1427 | 1403–1451 | 第 83 / 362 名 | 581 |
| 创意写作 | 1394 | 1377–1411 | 第 88 / 372 名 | 1,156 |
| 指令遵循 | 1416 | 1405–1427 | 第 88 / 374 名 | 2,634 |
| 中文 | 1440 | 1410–1471 | 第 112 / 344 名 | 350 |
来源:LMArena · CC BY 4.0 · 更新于 2026-07-12 · 评测方法 ↗ · 排名为 LMArena 文本榜单(风格控制) 各类别内的比较,分数来自第三方人类偏好评测,并非 OFOX 官方评分。
相关模型
常见问题
Qwen3 Max 在 Ofox.ai 上的价格为输入 $0.36/M/百万 Token,输出 $1.43/M/百万 Token。按量计费,无月费。
Qwen3 Max 支持 256K Token 的上下文窗口,最大输出 64K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.ai/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
Qwen3 Max 支持以下能力:函数调用, 推理, 提示缓存。通过 Ofox.ai 统一 API 访问所有功能。