GPT-5.6 发布 🎉 GPT 全系 8 折 🎉 直降 20% 整个 7 月 🔥查看详情
OfoxAI × 万事达卡 🎉 开卡刷卡送 $50 Token 代金券 · 限量 1000 份查看详情
Qwen

Qwen Flash

Chat
bailian/qwen-flash
对比开始使用

Qwen Flash 是阿里巴巴 Qwen 系列中速度最快、成本最低的模型,通过 Dashscope 提供服务,专为延迟敏感型任务打造。它在提供极速推理的同时支持工具调用(function calling)、提示缓存和联网搜索,输入价格为 $0.022/M tokens,输出为 $0.22/M tokens。上下文窗口:1M tokens,输出:32K。支持 OpenAI 与 Anthropic 两种协议接入。

上下文窗口
1M
最大输出 Token
32K
发布日期
2025-07-28
能力
函数调用提示缓存网络搜索
可用供应商
BaiLianAliyun
支持的协议
OpenAIopenaiAnthropicanthropic

供应商

BaiLianAliyun
输入 Token
$0.022/M
输出 Token
$0.22/M
缓存读取
$0.0043/M
缓存写入
$0.027/M
网络搜索
$0.01/R
接入协议
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

代码示例

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

常见问题

Qwen Flash 在 Ofox.ai 上的价格为输入 $0.022/M/百万 Token,输出 $0.22/M/百万 Token。按量计费,无月费。