Вышла GPT-5.6 🎉 GPT −20% 🎉 Вся линейка, весь июль 🔥Подробнее
Qwen

Qwen3 Coder Flash

Chat
bailian/qwen3-coder-flash
СравнитьНачать

Qwen3-Coder-Flash — экономичная coding-модель Alibaba на базе архитектуры Qwen3. Наследует agentic coding возможности Qwen3-Coder-Plus, поддерживает многоходовое взаимодействие с инструментами и оптимизирована для понимания кода на уровне репозитория с повышенной стабильностью вызовов инструментов. Контекстное окно: 1M tokens, вывод: 64K. Доступна через OpenAI и Anthropic протоколы.

Контекстное окно
1M
Макс. выходных токенов
64K
Дата релиза
2025-08-05
Возможности
Function CallingРассуждениеКэширование промптов
Доступные провайдеры
BaiLianAliyun
Поддерживаемые протоколы
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Входные токены
$0.5/M
Выходные токены
$2.5/M
Чтение кэша
$0.06/M
Запись кэша
$0.27/M
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Примеры кода

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3-coder-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Часто задаваемые вопросы

Qwen3 Coder Flash на Ofox.ai стоит $0.5/M за миллион входных токенов и $2.5/M за миллион выходных токенов. Оплата по потреблению, без абонплаты.