GPT-5.6 發布 🎉 GPT 全系 8 折 🎉 直降 20% 整個 7 月 🔥查看詳情
Qwen

Qwen Flash

Chat
bailian/qwen-flash
對比開始使用

Qwen Flash 是阿里巴巴 Qwen 系列中速度最快、成本最低的模型,透過 Dashscope 提供服務,專為延遲敏感的任務打造。它在提供極速推論的同時支援工具呼叫(function calling)、提示快取與網路搜尋,輸入價格為 $0.022/M tokens,輸出為 $0.22/M tokens。上下文視窗:1M tokens,輸出:32K。支援 OpenAI 與 Anthropic 兩種協定接入。

上下文視窗
1M
最大輸出 Token
32K
發布日期
2025-07-28
能力
函式呼叫提示快取網路搜尋
可用供應商
BaiLianAliyun
支援的協定
OpenAIopenaiAnthropicanthropic

供应商

BaiLianAliyun
輸入 Token
$0.022/M
輸出 Token
$0.22/M
快取讀取
$0.0043/M
快取寫入
$0.027/M
網路搜尋
$0.01/R
接入协议
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

程式碼範例

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

常見問題

Qwen Flash 在 Ofox.ai 上的價格為輸入 $0.022/M/百萬 Token,輸出 $0.22/M/百萬 Token。按量計費,無月費。