Qwen 3.8 Max:料金・コンテキスト長・APIアクセス方法(2026)

Qwen 3.8 Maxが2026年8月3日にGA。100万トークンあたり$2/$6、コンテキスト1M、出力上限131K、オープンウェイトは来週。ofoxでbailian/qwen3.8-maxとして利用可能。

Qwen 3.8 Max:料金・コンテキスト長・APIアクセス方法(2026)

Qwen 3.8 Maxが出ました。 Alibabaは2026年8月3日にリリースしました。プレビューから2週間後です。数字が噂でなくなったのはこのリリースからです。

  • リリース: 2026年8月3日(プレビューは2026年7月19日発表)
  • 料金: QwenCloudで入力$2.00/1M、出力$6.00/1M
  • コンテキスト: 1Mウィンドウ(最大入力991K、最大出力131K)
  • 規模: 2.4兆パラメータ、アクティブ950億
  • オープンウェイト: 来週と発表、ライセンスも日付も未公開
  • 今日使える経路: QwenCloud API、Qwen Studio、QwenWork
  • ofox: 提供中、bailian/qwen3.8-max、OpenAIとAnthropicの両プロトコル

台座に載った大きな木箱の蓋が数センチ持ち上がり、その隙間からオレンジ色の光が漏れている。クリーム色とチャコールグレーの厚紙を重ねて切り出したジオラマ

TL;DR

  • 新フラッグシップは前世代より安い。$2/$6に対しQwen 3.7 Maxは$2.50/$7.50。
  • 最大出力が131Kトークンへ倍増。1Mのコンテキストウィンドウは据え置き。
  • AlibabaはMaxクラスのモデルを初めてオープンウェイト化する。Qwen 3.8-27Bも同時、時期は「来週」(発表済み、日付未定)。
  • 公式ベンチマーク表ではエージェント系の多くの行でClaude Opus 4.8を上回りSWE-bench ProとHLEではFable 5に劣る。ベンダー作成の表である点に注意。
  • その表にKimi K3の列がない。多くの人が最も見たかった比較がそこにない。
  • すでにofoxで提供中bailian/qwen3.8-maxとして、OpenAIとAnthropicの両プロトコルで叩ける。AlibabaがClaude形状のエンドポイントを開くのを待たずにClaude Codeへ差し込める。

Qwen 3.8 Maxとは何か

Qwen 3.8 MaxはAlibabaのクローズドな最上位モデルで、トークンあたり950億をアクティブにする2.4兆パラメータのマルチモーダルシステムです。 新設計ではなくQwen 3.5アーキテクチャ上に構築されており、Alibabaは単発の対話ではなく長期の自律作業向けと位置づけています。

入出力:

対応状況
入力モダリティテキスト、画像、動画(QwenCloud)。ofoxではテキストと画像、動画は未記載
出力モダリティテキスト
API機能Function calling、構造化出力、コンテキストキャッシュ、プレフィックス補完
レート制限(QwenCloud)2Mトークン/分、15Kリクエスト/分

ローンチ記事は多日にわたる自律実行に大きく寄せています。目玉のデモは無人のコーディング実行で、公開リポジトリ上で約16日間に265コミット、127PR、151イシューを生み出しました。それが自社のコードベースにも一般化するかどうかは、ローンチ記事が答えられない唯一の点です。

Qwen 3.8 Maxはいつリリースされたか

2026年8月3日です。 プレビューが先にあり、この2つの日付は報道でしばしば混同されています。

  • 2026年7月19日: 上海のWAICでQwen3.8-Max-Previewを発表。AlibabaのToken Planサブスクリプション、Qoder、QoderWork経由でのみ到達可能。従量課金API、モデルカード、ベンチマーク表のいずれもなし。
  • 2026年8月3日: 一般提供。QwenCloud APIが開放され、価格が公開され、完全なベンチマーク表が公開され、オープンウェイトの時期が発表された。

この2つの間の日付の記事は「価格未公開」「ベンチマークなし」の記述が古くなっています。プレビュー期の「定価の10%」割引に言及したものも同様で、あれはToken Planのプレビュー期間だけの話です。

Qwen 3.8 Maxはオープンソースか

今日時点ではまだです。Alibabaはウェイトを来週、2026年8月10日の週に出すと述べています。

実際に発表された内容:

  • Qwen 3.8 Maxのウェイトが公開される。Qwen-Maxクラスのモデルがオープンウェイトになるのは初という表現。
  • Qwen 3.8-27Bも同じタイミングでオープンウェイト化。実際に動かせるのは多くの人にとってこちら。
  • ライセンスの明示なし。正確な日付なし。オープン版のモデルカードやアクティブパラメータの内訳もなし。

ウェイトが実際に出るまで、3点は保留で扱ってください。ベンダーの「来週」は計画であって出荷日ではありません。商用利用ではライセンスのほうが時期より重要です。Qwenのオープンリリースは従来Apache 2.0で出ています(Qwen3-235B-A22Bは現在もHugging Faceでapache-2.0)が、それは前例であってMaxクラスでの約束ではありません。そして2.4T・アクティブ95Bのモデルはワークステーションで自己ホストする規模ではなく、ハードウェアの見通しが立つのは27Bのほうです。

Qwen 3.8 Maxの料金

QwenCloudで入力100万トークンあたり$2.00、出力100万トークンあたり$6.00(2026年8月3日時点)。 新フラッグシップは置き換え対象より20%安いことになります。

Qwen 3.8 Max(QwenCloud)Qwen 3.7 Max(Model Studio、シンガポール)
入力 / 1M$2.00$2.50
出力 / 1M$6.00$7.50
暗黙キャッシュ読み取り / 1M$0.25記載なし
明示キャッシュ書き込み / 1M$2.50記載なし
明示キャッシュ読み取り / 1M$0.17記載なし

この表には注意点が2つあります。キャッシュの行は別々の価格表から来ており直接比較できません。ofoxのQwen 3.7 Maxページはキャッシュ読み取り$0.50/M、書き込み$3.125/Mと記載していますが、これはゲートウェイの掲載値でありAlibabaのものではありません。またModel Studioのシンガポール価格表は確認時点で3.7 Maxに期間限定50%オフを表示していたため、実効差は定価同士の比較より小さくなることがあります。

この表の両側の価格は動きます。コストモデルを組む前に現在値を自分で取得してください。

コンテキストウィンドウと最大出力は

合計1Mトークン。最大入力991K、最大出力131Kに分かれ、推論には別途262Kの上限があります。

  • コンテキストウィンドウ: 1M
  • 最大入力: 991K
  • 最大出力: 131K
  • 最大推論トークン: 262K

実質的な変化は出力上限です。ofoxはQwen 3.7 Maxを同じ1Mウィンドウで最大出力64Kと記載しているので、3.8 Maxは1応答あたりの出力量が倍になります。これはAlibabaが狙う負荷にとって重要です。262Kの推論トークンで計画を立てながら成果物を書くのに64Kしかないモデルは、途中で切れるモデルです。

公式ベンチマークは何を示しているか

Alibabaはローンチ時に完全な比較表を公開しましたが、全勝ではなく勝ち負けが混在しています。 以下の数値はすべてベンダー申告です。

主要行、Qwen 3.8 Max対フロンティア勢:

ベンチマークQwen 3.8 MaxOpus 4.8Fable 5GPT-5.6 Sol (max)Qwen 3.7 Max
Terminal Bench 2.186.684.684.688.874.5
SWE-bench Pro67.769.280.064.660.6
PaperBench93.080.388.890.564.8
GPQA Diamond92.692.092.694.192.4
HLE43.645.753.347.241.4
IFBench82.862.263.572.779.1
OSWorld-Verified86.183.485.083.273.3
MMMU-Pro82.375.681.283.079.0

いつも通り割り引いて読んでください。競合のTerminal Benchの数値はQwenが再実行したものではなく、Artificial AnalysisとOpenAI自身の投稿から引用されています。SWE-bench Proの行はClaude Codeハーネス、temp 1.0、top_p 0.95、256Kコンテキストという、Qwenが選んだ構成での測定です。表にはQwen自社製のベンチマーク(QwenSWEBench、QwenQoderBench、QwenReactBench)の行もあり、そこで測られているのは名前を共有するモデルです。

表の中の何よりも雄弁なのは欠落です。Kimi K3の列がありません。 Moonshotのオープンウェイト・フラッグシップはQwen 3.8プレビューの数日前に出ており、Qwen 3.8 Maxについて最もよく聞かれる比較対象です。Alibabaは代わりに西側のクローズドモデル3つと自社の前世代を並べました。

Qwen 3.8 Maxへのアクセス方法

今日はQwenCloud経由です。 一次経路が3つ、そして広く報道された4つ目は自分で確認が要ります。

  • QwenCloud API。モデルID qwen3.8-max、開発者向けの経路。キーはhome.qwencloud.com/api-keysから。
  • Qwen Studiochat.qwen.ai、チャットインターフェース。
  • QwenWork。非開発者向けの業務エージェントプラットフォーム。
  • Alibaba Cloud Model Studio。SCMPは8月3日にグローバルAPIアクセスを報じました。ただし同日の確認時点でModel Studioの英語モデル一覧と価格表はqwen3.7-max止まりでした。エンドポイントは共通でも、カタログページが告知に遅れています。

この最後の点はブランド名に隠れているので補足します。QwenCloud自身の開発者ガイドが叩くOpenAI互換エンドポイントはhttps://dashscope-intl.aliyuncs.com/compatible-mode/v1で、キーはDASHSCOPE_API_KEYから読みます。Model Studioと同じDashScope国際ホストです。QwenCloudはその基盤の上のフロントエンドであって、別のAPIではありません。

呼び出しはOpenAI形状です:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)

resp = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "このリポジトリのテスト戦略を要約して。"}],
    max_tokens=4096,
)
print(resp.choices[0].message.content)

Alibabaが用意していない経路: Anthropicプロトコル

QwenのAPIはOpenAI形状のみなので、Claude Codeはqwen3.8-maxを直接呼べません。 Claude CodeはAnthropic Messagesプロトコルを話し、譲りません。ゲートウェイがこの隙間を初日に埋めます。

bailian/qwen3.8-maxはローンチと同じ日にofoxで公開されました。2026年8月3日のカタログ呼び出しでは123モデルが返り新IDが含まれ、モデルページには入力$2/M、出力$6/M、キャッシュ読み取り$0.25/M、書き込み$2.50/M、コンテキスト長1,131,072、補完上限131,072と記載されています。価格は4行ともQwenCloudの定価と一致します。

ひとつ注意喚起を。危うく引っかかるところでした。カタログのsupported_endpointsフィールドには/v1/chat/completions/v1/responsesしか載っておらず、Anthropic経路が閉じているように読めます。閉じていません。2026年8月3日の実際のMessages呼び出しはstop_reason: end_turnを含む正常な応答を返しました。このフィールドを前提に設計する前に、実リクエストを1本投げてください。

シェル2行でClaude Codeに差し込めます:

export ANTHROPIC_BASE_URL=https://api.ofox.ai/anthropic
export ANTHROPIC_MODEL=bailian/qwen3.8-max

あるいは上のPythonのまま引数を2つ変えるだけです:

client = OpenAI(
    api_key=os.getenv("OFOX_API_KEY"),
    base_url="https://api.ofox.ai/v1",
)
resp = client.chat.completions.create(model="bailian/qwen3.8-max", ...)

どちらの経路を取るか:

求めるものQwenCloudに直接ゲートウェイ経由
最安のトークン単価はい、これが定価ここでは定価と同額。モデルごとに要確認
Qwen独自機能への初日アクセスはいゲートウェイの追随分だけ遅れる
Claude CodeなどAnthropicプロトコル系のツール今日は不可可能
Qwen・Claude・GPT・Geminiを1キーで不可可能
特定ベンダーのレート制限時のフェイルオーバー自前で構築標準装備

正直な代償として、ゲートウェイは自分で制御できないホップを1つ増やしますし、その価格表はベンダーの期中改定に遅れることがあります。マーケティングページではなくモデルページを読んでください。これは自社についても同じです。

Qwen 3.8 Max対Qwen 3.7 Max

安くなり、出力上限が倍になり、エージェント系ベンチマークが大きく伸びた。

Qwen 3.8 MaxQwen 3.7 Max
リリース2026-08-032026-05-19
パラメータ2.4T(アクティブ95B)未公開
コンテキスト / 最大出力1M / 131K1M / 64K(ofox掲載)
入力 / 出力(1Mあたり)$2.00 / $6.00$2.50 / $7.50
Terminal Bench 2.186.674.5
SWE-bench Pro67.760.6
ofoxあり、bailian/qwen3.8-maxあり、bailian/qwen3.7-max

特段の理由がなければ3.8 Maxを選んでください。安く、1応答で書ける量が倍で、どちらも同じキーで到達できるため、移行は統合作業ではなくモデルIDの差し替えで済みます。3.7 Maxに留まるのは、再現性のためにバージョンを固定している場合か、評価セットがそれに合わせて較正されている場合だけです。価格差は20%であって桁違いではないので、コストだけでは移行の決め手になりません。前世代の詳細はQwen 3.7 MaxのCoding Arena評価とClaude Opus比較を参照してください。

このローンチが再燃させたベンダー横断の問いについては、Kimi K3対GPT-5.5・Opus 4.8がオープンウェイト側を、Kimi K3の使い方がアクセス方法を扱っています。両方とも今日ofoxで使えます。K3はmoonshotai/kimi-k3、こちらはbailian/qwen3.8-maxなので、比較は調達判断ではなくモデルIDの差し替えです。

FAQ

Qwen 3.8 Maxはいつ出ましたか? 2026年8月3日、価格とベンチマークを伴う一般提供リリースです。プレビュー版は2026年7月19日発表で、AlibabaのToken Plan、Qoder、QoderWorkに限定されていました。

Qwen 3.8 Maxは無料ですか? 無料ではありません。QwenCloudでトークン課金、1Mあたり$2/$6です。7月のプレビューはToken Plan加入者向けに定価の10%と報じられましたが、その期間は終了しています。

Qwen 3.8 Maxのウェイトをダウンロードできますか? まだできません。Alibabaは2026年8月10日の週にオープンウェイトを公開すると発表しましたが、ライセンスも正確な日付もありません。同じ発表に含まれるQwen 3.8-27Bが、現実的な自己ホストの対象です。

Qwen 3.8 Maxは画像入力に対応していますか? 画像は対応、動画は要注意です。QwenCloudのモデルページは入力モダリティにテキスト・画像・動画を挙げ、Alibabaのマルチモーダル表はMMMU-Pro 82.3、OSWorld-Verified 86.1を報告しています。ofox経由では2026年8月3日に送った画像が正しく説明され、プロンプトトークンが60から90へ増えたので画像入力は有効です。ただし動画はofoxのカタログエントリに含まれていないため、使えると仮定しないでください。

Qwen 3.8 MaxをClaude Codeで使えますか? QwenCloudに直接ではできません。Claude CodeはAnthropic Messagesプロトコルを話し、QwenCloudはOpenAI形状だからです。両方を話すゲートウェイ経由なら初日から動きます(2026年8月3日に実測)。ANTHROPIC_BASE_URLhttps://api.ofox.ai/anthropicに向け、ANTHROPIC_MODEL=bailian/qwen3.8-maxを設定してください。

Qwen 3.8 MaxとQwen 3.8-27Bの違いは? Maxは2.4Tのクローズドなフラッグシップで、現在APIで利用できます。27Bははるかに小さいモデルで、来週のオープンウェイト公開で発表されています。同世代ですが規模のクラスが違います。

Qwen 3.8 MaxはKimi K3より優れていますか? Alibabaはその比較を公開していません。ベンチマーク表にK3の列はありません。可用性の面でも対等ではなく、K3には現時点でオープンウェイトと幅広いゲートウェイ対応がありますが、3.8 Maxにはまだありません。

今回確認したソース

よくある質問

Qwen 3.8 Maxはいつリリースされましたか?
2026年8月3日です。AlibabaのQwenチームが同日に「Qwen3.8-Max: A New Bar for Coding and Cowork」を公開し、同時にQwenCloudのAPIを開放しました。それ以前にプレビュー版があり、Qwen3.8-Max-Previewは2026年7月19日に発表され、AlibabaのToken Planサブスクリプション、Qoder、QoderWork経由でのみ利用できました。8月3日はGA(一般提供)であって、初出ではありません。
Qwen 3.8 Maxはオープンソースですか?
現時点ではまだですが、Alibabaは公開すると述べています。ローンチ記事には、Qwen-Maxクラスのモデルのウェイトを公開するのはこれが初めてであり、公開は「来週」つまり2026年8月10日の週だと書かれています。Qwen3.8-27Bも同じタイミングでオープンウェイト化されます。8月3日時点の確認では、ライセンス、正確な日付、いずれのモデルカードも未公開です。したがってこの時期は「発表済み」であって「確定」ではありません。
Qwen 3.8 Maxの料金はいくらですか?
QwenCloudでは入力100万トークンあたり$2.00、出力100万トークンあたり$6.00です(2026年8月3日時点)。キャッシュは別料金で、暗黙キャッシュ読み取り$0.25/M、明示キャッシュ書き込み$2.50/M、明示キャッシュ読み取り$0.17/Mです。これは前世代より安く、Qwen 3.7 MaxはAlibaba Cloud Model Studioのシンガポール価格表で入力$2.50、出力$7.50でした。新フラッグシップは両側とも20%の値下げです。
Qwen 3.8 Maxのコンテキストウィンドウは?
合計1Mトークンで、QwenCloudのモデルページでは最大入力991K、最大出力131Kに分けられ、推論トークンには別途262Kの上限があります。注目すべきは131Kという出力上限です。ofoxではQwen 3.7 Maxの最大出力が64Kなので、同じ1Mウィンドウのまま1回の応答で書ける量が約2倍になりました。
Qwen 3.8 Maxにアクセスするには?
2026年8月3日時点で一次経路は3つです。QwenCloud API、chat.qwen.aiのQwen Studioチャット、そして非開発者向けのQwenWorkです。APIはOpenAI互換で、QwenCloudの開発者ガイドはhttps://dashscope-intl.aliyuncs.com/compatible-mode/v1をDASHSCOPE_API_KEYで叩くよう案内しています。これはAlibaba Cloud Model Studioと同じDashScope国際ホストです。確認時点でModel Studioの英語モデル一覧と価格表は最新のMaxがqwen3.7-maxのままで、カタログページがローンチに遅れています。
Qwen 3.8 Maxはofoxで使えますか?
使えます。モデルIDはbailian/qwen3.8-maxで、ローンチ当日に追加されました。2026年8月3日のGET /v1/models実行では123モデルが返り、新エントリが含まれていました。ofoxのモデルページには入力$2/M、出力$6/M、キャッシュ読み取り$0.25/M、キャッシュ書き込み$2.50/M、コンテキスト長1,131,072、補完上限131,072と記載され、価格4行すべてがQwenCloudの定価と一致します。同日の実測でOpenAIプロトコルとAnthropicプロトコルの両方が応答しました。Claude、GPT、Geminiと同じキーで使えます。
Qwen 3.8 Maxのパラメータ数は?
総パラメータ2.4兆、トークンごとのアクティブパラメータ950億で、Qwen 3.5アーキテクチャ上に構築されています。推論コストと速度に効くのはアクティブ側の数字で、各トークンが総ウェイトの約4%だけを通ることを意味します。Alibabaは8月3日のローンチ記事で両方の数字を開示しました。7月のプレビュー時は2.4Tという総数しか公開されていませんでした。
Qwen 3.8 MaxはClaude Opus 4.8やGPT-5.6より優れていますか?
タスク次第であり、以下の数値はすべてAlibaba自身の表からのものです。Qwen 3.8 MaxはPaperBench(93.0)、IFBench(82.8)、OSWorld-Verified(86.1)で表の首位です。一方Terminal Bench 2.1(86.6、GPT-5.6 Sol maxは88.8)、SWE-bench Pro(67.7、Fable 5は80.0)、HLE(43.6、Fable 5は53.3)では下回ります。ベンダー実施の表はハーネスを自ら選べるため、確定した順位ではなく検証すべきローンチ時の主張として扱ってください。