Вышла GPT-5.6 🎉 GPT −20% 🎉 Вся линейка, весь июль 🔥Подробнее
Qwen

Qwen Flash

Chat
bailian/qwen-flash
СравнитьНачать

Qwen Flash — самая быстрая и самая доступная модель семейства Qwen от Alibaba, предоставляемая через Dashscope и созданная для задач, чувствительных к задержкам. Она обеспечивает сверхбыстрый вывод и поддерживает вызов инструментов (function calling), кэширование промптов и веб-поиск по цене $0.022/M токенов на входе и $0.22/M на выходе. Контекстное окно: 1M токенов, вывод: 32K. Доступна через протоколы OpenAI и Anthropic.

Контекстное окно
1M
Макс. выходных токенов
32K
Дата релиза
2025-07-28
Возможности
Function CallingКэширование промптовВеб-поиск
Доступные провайдеры
BaiLianAliyun
Поддерживаемые протоколы
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Входные токены
$0.022/M
Выходные токены
$0.22/M
Чтение кэша
$0.0043/M
Запись кэша
$0.027/M
Веб-поиск
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Примеры кода

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Часто задаваемые вопросы

Qwen Flash на Ofox.ai стоит $0.022/M за миллион входных токенов и $0.22/M за миллион выходных токенов. Оплата по потреблению, без абонплаты.