Qwen 3.8 Max: цена, контекст и доступ к API (2026)

Qwen 3.8 Max вышел 3 августа 2026: $2/$6 за 1M токенов, контекст 1M, вывод до 131K, открытые веса на следующей неделе. Уже на ofox как bailian/qwen3.8-max.

Qwen 3.8 Max: цена, контекст и доступ к API (2026)

Qwen 3.8 Max вышел. Alibaba выпустила его 3 августа 2026 года, через две недели после превью. Это тот релиз, после которого цифры перестали быть слухами.

  • Релиз: 3 августа 2026 (превью анонсировано 19 июля 2026)
  • Цена: $2.00 за 1M входа, $6.00 за 1M вывода на QwenCloud
  • Контекст: окно 1M (максимум входа 991K, вывода 131K)
  • Размер: 2,4T параметров, 95B активных
  • Открытые веса: объявлены на следующую неделю, лицензии и даты пока нет
  • Доступ сегодня: API QwenCloud, Qwen Studio, QwenWork
  • На ofox: да, bailian/qwen3.8-max, протоколы OpenAI и Anthropic

Большой бумажный ящик на постаменте с приподнятой на несколько сантиметров крышкой, из щели пробивается оранжевый свет; вырезано из слоёв кремового и угольно-серого картона

TL;DR

  • Новый флагман дешевле предыдущего: $2/$6 против $2.50/$7.50 у Qwen 3.7 Max.
  • Максимальный вывод удвоился до 131K токенов, окно контекста 1M осталось прежним.
  • Alibaba впервые откроет веса модели класса Max, вместе с Qwen 3.8-27B, «на следующей неделе» (объявлено, дата не названа).
  • В официальной таблице бенчмарков модель опережает Claude Opus 4.8 в большинстве агентских строк и уступает Fable 5 на SWE-bench Pro и HLE. Таблица вендорская.
  • В этой таблице нет колонки Kimi K3, а именно это сравнение хотели увидеть большинство.
  • Модель уже на ofox как bailian/qwen3.8-max, по обоим протоколам, OpenAI и Anthropic, так что она подключается к Claude Code без ожидания, пока Alibaba откроет эндпоинт в форме Claude.

Что такое Qwen 3.8 Max

Qwen 3.8 Max — это закрытая топовая модель Alibaba, мультимодальная система на 2,4 триллиона параметров с 95 миллиардами активных на токен. Она построена на архитектуре Qwen 3.5, а не на новой, и Alibaba позиционирует её вокруг долгой автономной работы, а не одиночных ответов в чате.

Вход и выход:

Поддержка
Входные модальностиТекст, изображение, видео (QwenCloud); на ofox текст и изображение, видео не указано
Выходные модальностиТекст
Возможности APIFunction calling, структурированный вывод, кеш контекста, продолжение префикса
Лимиты (QwenCloud)2M токенов/мин, 15K запросов/мин

Пост о запуске сильно опирается на многодневную автономность. Главная демонстрация — прогон кодинга без присмотра, давший 265 коммитов, 127 PR и 151 issue примерно за 16 дней в публичном репозитории. Переносится ли это на вашу кодовую базу — единственное, чего пост о запуске сказать не может.

Когда вышел Qwen 3.8 Max

3 августа 2026 года. Сначала было превью, и эти две даты в публикациях часто смешивают:

  • 19 июля 2026. Qwen3.8-Max-Preview анонсирован на WAIC в Шанхае. Доступ только через подписку Token Plan, Qoder и QoderWork. Ни API с оплатой по факту, ни карточки модели, ни таблицы бенчмарков.
  • 3 августа 2026. Общедоступность. Открывается API QwenCloud, публикуются цены, публикуется полная таблица бенчмарков, объявляются сроки открытия весов.

Любой материал с датой между этими двумя содержит устаревшие утверждения «цен нет» и «бенчмарков нет», включая тексты со ссылкой на скидку «10% от стандартной цены» — она действовала только в окне превью Token Plan.

Открытый ли Qwen 3.8 Max

Сегодня нет. Alibaba говорит, что веса выйдут на следующей неделе, на неделе 10 августа 2026 года.

Что было объявлено на самом деле:

  • Веса Qwen 3.8 Max будут опубликованы, и это описано как первый случай открытия весов модели класса Qwen-Max.
  • Qwen 3.8-27B открывают в той же волне, и именно её большинство сможет реально запустить.
  • Лицензия не названа. Точной даты нет. Ни карточки модели, ни разбивки активных параметров для открытого релиза.

Три вещи стоит держать в уме до фактической публикации. Вендорское «на следующей неделе» — это план, а не дата отгрузки. Для коммерческого использования лицензия важнее сроков: открытые релизы Qwen исторически выходили под Apache 2.0 (у Qwen3-235B-A22B на Hugging Face до сих пор стоит apache-2.0), но это прецедент, а не обязательство для модели класса Max. И модель на 2,4T с 95B активных — не тот случай, когда её разворачивают на рабочей станции; реалистичная история по железу — у 27B.

Сколько стоит Qwen 3.8 Max

$2.00 за 1M входных токенов и $6.00 за 1M выходных на QwenCloud, снимок от 3 августа 2026 года. Новый флагман на 20% дешевле модели, которую он заменяет.

Qwen 3.8 Max (QwenCloud)Qwen 3.7 Max (Model Studio, Сингапур)
Вход / 1M$2.00$2.50
Выход / 1M$6.00$7.50
Неявное чтение кеша / 1M$0.25не указано
Явная запись в кеш / 1M$2.50не указано
Явное чтение кеша / 1M$0.17не указано

Два замечания к таблице. Строки по кешу взяты из разных прайсов и напрямую не сопоставимы: страница Qwen 3.7 Max на ofox указывает чтение кеша $0.50/M и запись $3.125/M, но это листинг шлюза, а не Alibaba. И сингапурский прайс Model Studio на момент проверки показывал для 3.7 Max ограниченную по времени скидку 50%, так что фактический разрыв может быть меньше, чем кажется при сравнении прайс к прайсу.

Цены с обеих сторон этой таблицы меняются. Прежде чем строить на них модель затрат, вытяните актуальные цифры сами.

Каковы контекстное окно и максимальный вывод

Всего 1M токенов: 991K максимального входа и 131K максимального вывода, плюс отдельный потолок 262K на рассуждения.

  • Окно контекста: 1M
  • Максимальный вход: 991K
  • Максимальный вывод: 131K
  • Максимум токенов рассуждения: 262K

Настоящее изменение — потолок вывода. ofox указывает для Qwen 3.7 Max максимум 64K на том же окне 1M, так что 3.8 Max удваивает объём одного ответа. Для нагрузок, на которые целится Alibaba, это существенно: модель, которая планирует в пределах 262K токенов рассуждения, а на сам артефакт имеет 64K, — это модель, которая обрывается.

Что говорят официальные бенчмарки

Alibaba опубликовала полную сравнительную таблицу на запуске, и картина смешанная, а не разгромная. Все цифры ниже — от вендора.

Выборочные строки, Qwen 3.8 Max против фронтира:

БенчмаркQwen 3.8 MaxOpus 4.8Fable 5GPT-5.6 Sol (max)Qwen 3.7 Max
Terminal Bench 2.186.684.684.688.874.5
SWE-bench Pro67.769.280.064.660.6
PaperBench93.080.388.890.564.8
GPQA Diamond92.692.092.694.192.4
HLE43.645.753.347.241.4
IFBench82.862.263.572.779.1
OSWorld-Verified86.183.485.083.273.3
MMMU-Pro82.375.681.283.079.0

Читайте с обычной скидкой. Цифры конкурентов по Terminal Bench взяты из Artificial Analysis и собственных постов OpenAI, а не перезапущены Qwen, а строка SWE-bench Pro измерена на харнессе Claude Code при temp 1.0, top_p 0.95 и контексте 256K — конфигурация выбрана самой Qwen. Несколько строк — внутренние бенчмарки Qwen (QwenSWEBench, QwenQoderBench, QwenReactBench), где измеряют модель, разделяющую с ними имя.

Пробел в таблице громче всего, что в ней есть: колонки Kimi K3 нет. Открытый флагман Moonshot вышел за несколько дней до превью Qwen 3.8 и остаётся моделью, с которой Qwen 3.8 Max сравнивают чаще всего. Alibaba вместо этого выбрала три закрытые западные модели и собственное предыдущее поколение.

Как получить доступ к Qwen 3.8 Max

Сегодня — через QwenCloud. Есть три первичных маршрута и один широко упомянутый четвёртый, который нужно проверять.

  • API QwenCloud. Идентификатор модели qwen3.8-max, путь для разработчика. Ключи на home.qwencloud.com/api-keys.
  • Qwen Studio. chat.qwen.ai, чат-интерфейс.
  • QwenWork. Платформа рабочих агентов для не-разработчиков.
  • Alibaba Cloud Model Studio. SCMP сообщила о глобальном доступе к API 3 августа. При этом английский список моделей и прайс Model Studio в тот же день всё ещё заканчивались на qwen3.7-max: страницы каталога отстают от анонса, хотя эндпоинт общий.

Последний пункт стоит развернуть, потому что брендинг его прячет. Собственные руководства QwenCloud обращаются к OpenAI-совместимому эндпоинту https://dashscope-intl.aliyuncs.com/compatible-mode/v1 и читают ключ из DASHSCOPE_API_KEY — тот же международный хост DashScope, что использует Model Studio. QwenCloud — это фронтенд поверх той же инфраструктуры, а не отдельный API.

Вызов в форме OpenAI:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)

resp = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Кратко опиши стратегию тестирования этого репозитория."}],
    max_tokens=4096,
)
print(resp.choices[0].message.content)

Маршрут, которого Alibaba не предлагает: протокол Anthropic

У Qwen API только в форме OpenAI, поэтому Claude Code не может вызвать qwen3.8-max напрямую. Claude Code говорит на протоколе Anthropic Messages и не идёт на уступки. Шлюз закрывает этот разрыв в первый же день.

bailian/qwen3.8-max появился на ofox в день запуска. Вызов каталога 3 августа 2026 года вернул 123 модели с новым идентификатором, а страница модели указывает $2/M на входе, $6/M на выходе, чтение кеша $0.25/M, запись $2.50/M, длину контекста 1 131 072 и потолок ответа 131 072. Цены совпадают с прайсом QwenCloud по всем четырём строкам.

Об этом стоит предупредить, потому что нас едва не поймало. Поле supported_endpoints в каталоге перечисляет только /v1/chat/completions и /v1/responses, из чего кажется, что маршрут Anthropic закрыт. Он не закрыт: живой вызов Messages 3 августа 2026 года вернул корректный ответ с stop_reason: end_turn. Отправьте один реальный запрос, прежде чем закладываться на это поле.

Две строки шелла подключают модель к Claude Code:

export ANTHROPIC_BASE_URL=https://api.ofox.ai/anthropic
export ANTHROPIC_MODEL=bailian/qwen3.8-max

Или оставьте Python выше и поменяйте два аргумента:

client = OpenAI(
    api_key=os.getenv("OFOX_API_KEY"),
    base_url="https://api.ofox.ai/v1",
)
resp = client.chat.completions.create(model="bailian/qwen3.8-max", ...)

Какой маршрут выбрать:

Что вам нужноНапрямую в QwenCloudЧерез шлюз
Минимальная цена за токенДа, это и есть прайсЗдесь совпадает с прайсом, проверяйте по каждой модели
Доступ к новым функциям Qwen с нулевого дняДаОтстаёт настолько, насколько отстаёт шлюз
Claude Code и другие инструменты на протоколе AnthropicСегодня невозможноДа
Один ключ на Qwen, Claude, GPT и GeminiНетДа
Переключение при лимитах одного вендораСтроите самиВстроено

Честная оговорка: шлюз добавляет узел, который вы не контролируете, а его прайс может отставать от изменения цен вендора в середине цикла. Читайте страницу модели, а не маркетинговую страницу, и у нас в том числе.

Qwen 3.8 Max против Qwen 3.7 Max

Дешевле, вдвое выше потолок вывода и заметный скачок на агентских бенчмарках.

Qwen 3.8 MaxQwen 3.7 Max
Релиз2026-08-032026-05-19
Параметры2,4T (95B активных)Не раскрыто
Контекст / максимум вывода1M / 131K1M / 64K (листинг ofox)
Вход / выход за 1M$2.00 / $6.00$2.50 / $7.50
Terminal Bench 2.186.674.5
SWE-bench Pro67.760.6
На ofoxДа, bailian/qwen3.8-maxДа, bailian/qwen3.7-max

Берите 3.8 Max, если нет причин не брать. Он дешевле, пишет вдвое больше за ответ, и обе модели доступны по одному ключу, так что миграция — это замена идентификатора модели, а не переделка интеграции. Оставаться на 3.7 Max имеет смысл только если вы зафиксировали версию ради воспроизводимости или ваши оценки откалиброваны под неё. Разрыв в цене 20%, а не порядок величины, так что одна лишь стоимость переезд не оправдает. Про более дешёвого собрата — в сравнении 3.7 Plus и 3.7 Max.

По межвендорскому вопросу, который поднимает этот запуск: Kimi K3 против GPT-5.5 и Opus 4.8 закрывает сторону открытых весов, а как использовать Kimi K3 — доступ. Обе модели сегодня есть на ofox: K3 как moonshotai/kimi-k3, эта — как bailian/qwen3.8-max, так что сравнить их — вопрос смены идентификатора, а не закупки.

FAQ

Когда вышел Qwen 3.8 Max? 3 августа 2026 года, как общедоступный релиз с опубликованными ценами и бенчмарками. Превью-сборку анонсировали 19 июля 2026 года, она была ограничена Token Plan, Qoder и QoderWork.

Qwen 3.8 Max бесплатный? Нет. На QwenCloud оплата по токенам, $2/$6 за 1M. Июльское превью, по сообщениям, шло по 10% от стандартной цены для подписчиков Token Plan, но это окно закрыто.

Можно ли скачать веса Qwen 3.8 Max? Пока нет. Alibaba анонсировала открытие весов на неделе 10 августа 2026 года, без лицензии и точной даты. Qwen 3.8-27B входит в ту же анонсированную волну и является реалистичной целью для самостоятельного развёртывания.

Поддерживает ли Qwen 3.8 Max изображения? Изображения да, с оговоркой про видео. Страница модели QwenCloud перечисляет текст, изображение и видео как входные модальности, а мультимодальная таблица Alibaba даёт 82.3 на MMMU-Pro и 86.1 на OSWorld-Verified. Через ofox отправленное 3 августа 2026 года изображение было описано корректно, а число промпт-токенов выросло с 60 до 90, так что вход изображениями работает. Видео в записи каталога ofox нет, поэтому не рассчитывайте на него.

Можно ли использовать Qwen 3.8 Max с Claude Code? Напрямую с QwenCloud нет, потому что Claude Code говорит на протоколе Anthropic Messages, а QwenCloud в форме OpenAI. Через шлюз, который говорит на обоих, это работает с первого дня, проверено 3 августа 2026 года: направьте ANTHROPIC_BASE_URL на https://api.ofox.ai/anthropic и задайте ANTHROPIC_MODEL=bailian/qwen3.8-max.

Чем Qwen 3.8 Max отличается от Qwen 3.8-27B? Max — закрытый флагман на 2,4T, доступный сейчас через API. 27B — гораздо меньшая модель, анонсированная в составе открытия весов на следующей неделе. У них общее поколение, но разный класс размера.

Qwen 3.8 Max лучше Kimi K3? Alibaba такого сравнения не публиковала: колонки K3 в её таблице бенчмарков нет. По доступности они тоже не равны: у K3 сегодня есть открытые веса и широкая поддержка шлюзов, у 3.8 Max пока нет.

Проверенные источники

Часто задаваемые вопросы

Когда вышел Qwen 3.8 Max?
3 августа 2026 года. В тот же день команда Qwen опубликовала пост «Qwen3.8-Max: A New Bar for Coding and Cowork» и открыла доступ к API на QwenCloud. До этого была превью-сборка: Qwen3.8-Max-Preview анонсировали 19 июля 2026 года, и она была доступна только через подписку Alibaba Token Plan, Qoder и QoderWork. Релиз 3 августа — это общедоступность, а не первое появление модели.
Qwen 3.8 Max открытый?
Пока нет, но Alibaba обещает открыть веса. В посте о запуске сказано, что это будет первый случай открытия весов модели класса Qwen-Max и что веса выйдут «на следующей неделе», то есть на неделе 10 августа 2026 года. Qwen3.8-27B открывают в той же волне. На момент проверки 3 августа Alibaba не опубликовала ни лицензию, ни точную дату, ни карточку модели, поэтому сроки следует считать заявленными, а не подтверждёнными.
Сколько стоит Qwen 3.8 Max?
На QwenCloud — $2.00 за 1M входных токенов и $6.00 за 1M выходных на снимке от 3 августа 2026 года. Кеш тарифицируется отдельно: неявное чтение кеша $0.25/M, явная запись в кеш $2.50/M, явное чтение кеша $0.17/M. Это дешевле предшественника: Qwen 3.7 Max в сингапурском прайсе Alibaba Cloud Model Studio идёт по $2.50 на входе и $7.50 на выходе, то есть новый флагман дешевле на 20% с обеих сторон.
Какое контекстное окно у Qwen 3.8 Max?
Всего 1M токенов, на странице модели QwenCloud разбито на 991K максимального входа и 131K максимального вывода, плюс отдельный потолок в 262K на токены рассуждения. Показателен именно лимит вывода 131K: ofox указывает для Qwen 3.7 Max максимум 64K на выходе, так что новая модель примерно удваивает объём, который может выдать за один ответ, сохраняя то же окно в 1M.
Как получить доступ к Qwen 3.8 Max?
На 3 августа 2026 года есть три первичных маршрута: API QwenCloud, чат-интерфейс Qwen Studio на chat.qwen.ai и QwenWork для не-разработчиков. API OpenAI-совместимый: руководства QwenCloud указывают на https://dashscope-intl.aliyuncs.com/compatible-mode/v1 с ключом DASHSCOPE_API_KEY — это тот же международный хост DashScope, который использует Alibaba Cloud Model Studio. При проверке в тот же день английский каталог и прайс Model Studio всё ещё показывали qwen3.7-max как самый свежий Max, то есть страницы каталога отстают от запуска.
Есть ли Qwen 3.8 Max на ofox?
Есть, под идентификатором bailian/qwen3.8-max. Модель появилась в день запуска: живой вызов GET /v1/models 3 августа 2026 года вернул 123 модели, включая новую запись. Страница модели на ofox указывает $2/M на входе, $6/M на выходе, чтение кеша $0.25/M, запись в кеш $2.50/M, длину контекста 1 131 072 и потолок ответа 131 072 — все четыре ценовые строки совпадают с прайсом QwenCloud. В тот же день на живом тесте ответили и OpenAI-протокол, и Anthropic-протокол. Ключ тот же, что для Claude, GPT и Gemini.
Сколько параметров у Qwen 3.8 Max?
2,4 триллиона суммарно и 95 миллиардов активных на токен, на архитектуре Qwen 3.5. Для стоимости и скорости инференса важно именно число активных параметров: оно означает, что каждый токен проходит примерно через 4% всех весов. Оба числа Alibaba раскрыла в посте от 3 августа — в июльском превью публичной была только цифра 2,4T.
Qwen 3.8 Max лучше, чем Claude Opus 4.8 или GPT-5.6?
Зависит от задачи, и все цифры ниже взяты из собственной таблицы Alibaba. Qwen 3.8 Max лидирует в ней по PaperBench (93.0), IFBench (82.8) и OSWorld-Verified (86.1). Отстаёт по Terminal Bench 2.1 (86.6 против 88.8 у GPT-5.6 Sol max), по SWE-bench Pro (67.7 против 80.0 у Fable 5) и по HLE (43.6 против 53.3 у Fable 5). Вендорские таблицы сами выбирают харнесс, поэтому это заявление на момент запуска, которое стоит проверить, а не устоявшийся рейтинг.