Gemini 3.8 Flash vs 3.7 Flash:同じ価格、請求額は 45% 増
Gemini 3.8 Flash と 3.7 Flash のトークン単価は同一。しかし 3.8 Flash は出力を 30% 多く書くため、タスクあたり費用は $0.40 から $0.58 に上がり、得られるのは 3 ポイント。
Gemini 3.8 Flash の価格は Gemini 3.7 Flash とまったく同じです。Google の料金ページのすべてのセルが 2 つのモデルで同一で、2027 年 1 月 1 日に両方を倍にする脚注まで一緒です。請求額は同一ではありません。Artificial Analysis の計測では、3.8 Flash はタスクあたり 30% 多く出力トークンを使い、Intelligence Index タスクあたり費用は $0.40 から $0.58 に上がりました。
要点
- トークン単価:同じ。 入力 $0.75、出力 $3.75、キャッシュ入力 $0.075、Batch と Flex は半額、Priority は 1.8 倍。2027 年 1 月 1 日にすべて倍増。比べるものがありません。
- タスクあたり:high effort で 3.8 Flash は約 45% 高い。 Artificial Analysis で $0.58 対 $0.40、59 ポイント対 56 ポイント。同じ差を AA 自身は「約 40%」と丸めています。
- ほぼ無料のアップグレードは medium effort。 3.8 Flash はデフォルトの medium でタスクあたり $0.41 で 57。3.7 Flash より 1 ポイント上、1 セント高いだけ。
- Google は残ってもいいと言っている。 3.7 Flash は「効率優先のワークロードに対して引き続き完全にサポートされる」。ベンダー自身の言葉であって、私たちの意見ではありません。
Google が変えたもの、変えなかったもの
Gemini 3.8 Flash は 2026 年 9 月 2 日、8 月 13 日の 3.7 Flash から 3 週間後に出ました。Google の発表は違いを価格ではなく挙動として説明しています(以下の引用は訳文)。「3.8 Flash はより熱心に働きます。複雑なタスクではより高い勤勉さを示し、追加の推論ステップを実行し、ツールを反復的に呼び出します。時には、特に高い effort レベルでは、性能を最大化するためにより多くのトークンを使うことがあります。」
続いて、多くの記事が飛ばす推奨です。「開発者はトークンのオーバーヘッドを最小化するために低い effort レベルを利用するか、効率優先のワークロードに対して引き続き完全にサポートされる Gemini 3.7 Flash に頼り続けることができます。」開発者向けドキュメントも繰り返しています。「Gemini 3.8 Flash は、長時間実行される複雑なタスクでは設計上より多くのトークンを使うことがあります。」
つまりベンダーの枠組みは、同じ価格、1 回の呼び出しでより多くの仕事、そして 3.7 Flash への明示的な退路です。
Gemini 3.8 Flash vs 3.7 Flash:スペックと価格
| 項目 | Gemini 3.7 Flash | Gemini 3.8 Flash |
|---|---|---|
| リリース | 2026-08-13 | 2026-09-02 |
| 入力 / 出力、100 万トークンあたり | $0.75 / $3.75 | $0.75 / $3.75 |
| 2027-01-01 から | $1.50 / $7.50 | $1.50 / $7.50 |
| キャッシュ入力 | $0.075 | $0.075 |
| コンテキストウィンドウ | 1M トークン | 1M トークン |
| 最大出力 | 64K トークン | 64K トークン |
| thinking レベル | low / medium(デフォルト)/ high | low / medium(デフォルト)/ high |
minimal | エラーを返す | エラーを返す |
| AA Intelligence Index(high) | 56 | 59 |
| AA タスクあたり費用(high) | $0.40 | $0.58 |
| AA タスクあたり出力トークン(high) | — | 4 万 8000、「30% 増」 |
| AA 指数完走の出力トークン | 6400 万 | 1 億 2000 万 |
| AA 指数完走の費用 | $484.73 | $825.83 |
| AA 出力速度 | 約 287 トークン/秒 | 約 302 トークン/秒 |
| AA Time per Task(high) | 2.2 分 | 2.5 分 |
価格は Google の料金ページ、指数・トークン・費用・速度は Artificial Analysis、すべて 2026 年 9 月 3 日に確認。リリース日を除けば、違うのは最後の 7 行です。AA は費用と時間の行の変化を 2 つの要因に帰しています。タスクあたり出力トークンが 30% 増えたこと、そしてエージェント評価でのターン数が増えたことです。
Gemini 3.8 Flash は 3.7 Flash よりどれくらい優れているか
Gemini 3.8 Flash は Artificial Analysis Intelligence Index で high effort なら 59、Gemini 3.7 Flash は 56。その 3 ポイントにはタスクあたり約 45% 多い費用、$0.58 対 $0.40 がかかります。 Artificial Analysis はモデルと effort レベルごとに 1 つの総合スコアを公開しています。
| モデル、effort | AA Intelligence Index | AA タスクあたり費用 |
|---|---|---|
| Gemini 3.8 Flash、high | 59 | $0.58 |
| Gemini 3.8 Flash、medium(デフォルト) | 57 | $0.41 |
| Gemini 3.7 Flash、high | 56 | $0.40 |
| Gemini 3.8 Flash、low | 52 | $0.24 |
| Gemini 3.6 Flash、high | 52 | — |
費用の列を下に読めば話は明快です。Gemini 3.8 Flash の high(59)は 3.7 Flash の high(56)よりタスクあたり 45% 高い。medium(57)は 2.5% 高い。low(52)は 40% 安く、52 は 3.6 Flash がすでに持っていたスコアです。
AA 自身のリリース総括は「Intelligence Index 3 ポイントの改善」に対して「タスクあたり平均出力トークンが 30% 増えて 4 万 8000」。どちらの数字も high effort のものです。デフォルトの medium なら、追加支出をほとんどかけずに改善の大半が得られます。私たちが本番に出すならこの構成です。
Gemini 3.8 Flash のトークン使用量:追加の 30% はどこへ行くか
Gemini 3.8 Flash は high effort で 3.7 Flash よりタスクあたり約 30% 多い出力トークンを書き、Artificial Analysis によれば平均 4 万 8000。追加のトークンは追加の推論ステップと反復的なツール呼び出しに使われています。 請求額を決める 2 つの要素のうち、トークン単価は小さい方です。もう半分は、モデルが止まるまでにどれだけ書くかで、この世代ではその数字が動きました。
指数全体で AA は 3.7 Flash の出力トークンを 6400 万と記録し、「中央値 7100 万と比べてかなり簡潔」と評しています。3.8 Flash は 1 億 2000 万で「中央値と比べて非常に冗長」。AA が示すタスクあたり平均は 3.8 Flash の high で 4 万 8000、3.7 Flash より 30% 多い値です。
トークンの行き先は Google の説明どおりです。追加の推論ステップと反復的なツール呼び出しです。それを必要とするタスクでは、その分が 3 ポイントになります。必要ないタスクでは、同じ答えに対して 30% 多い出力が 100 万トークンあたり $3.75 で課金されます。あなたのトラフィックがどちらかは、ベンチマークには分かりません。自分の呼び出しの completion_tokens フィールドなら分かります。
速度はほぼ横並び
3.8 Flash は AA の計測で約 302 出力トークン/秒、3.7 Flash は 287。5% の速度向上は 30% のトークン増を相殺できず、そのため AA の Time per Task は下がるのではなく上がっています。high effort で 2.2 分から 2.5 分へ。最適化したいのが実時間のレイテンシなら、3.8 Flash の low effort のタスクあたり 0.8 分が使える手段で、代償はスコアです。
移行は文字列 1 つ
リクエストで変わるのはモデル名だけです。
- model="gemini-3.7-flash"
+ model="gemini-3.8-flash"
どちらのモデルも low、medium、high を受け付け、デフォルトは medium、minimal はエラーで拒否します。3.7 Flash API ガイドに正確な 400 レスポンスと、受け付けられる最安ティアの費用があります。コンテキストウィンドウと 64K の出力上限は変わりません。OpenAI 互換インターフェースではパラメータは reasoning_effort、Google のネイティブプロトコルでは thinking_level です。
切り替え後に再確認すべき点が 2 つあります。
- 出力予算とアラート。 同じレートで、high effort ではタスクあたり約 30% 多いトークン。3.7 Flash の出力量に合わせて調整したものはすべて発火します。
- effort レベル。 スコアが必要で 3.7 Flash を
highにしていたなら、まず 3.8 Flash のmediumを試してください。3.7 Flash の high より 1 ポイント高く、AA タスクあたりの差は 1 セントです。
Gemini 3.8 Flash にアップグレードすべきか
- タスクに 59 が必要で、3.7 Flash の 56 がそのタスクで実際に足りなかったことを、推測ではなく確認している。
- medium effort で出せる。タスクあたり $0.41 で 57 は、$0.40 で 56 の 3.7 Flash を全項目で上回ります。
- トラフィックがエージェント的でツール中心。Google が追加の推論ステップの行き先として挙げている領域です。
3.7 Flash に残るとき
- 3.7 Flash ですでに仕事が回っている。Google の言葉は「完全にサポート」で、価格面で動く理由はなく、high effort ではタスクあたり 45% という動かない理由があります。
- 出力量で課金しており、30% 増の余地がない。
- プロンプトが 3.7 Flash の挙動に合わせて調整済みで、再調整の費用が 1 ポイントの価値を超える。
両モデルが共有する崖
2027 年 1 月 1 日に両モデルは入力 $1.50、出力 $7.50 に倍増します。トークン数が変わらなければ、3.8 Flash の $0.58 / $0.41 / $0.24 のタスクあたり費用はおよそ $1.16 / $0.82 / $0.48 に、3.7 Flash の $0.40 はおよそ $0.80 になります。両者の 45% の差はその日をまたいで無傷で残り、動くのは絶対値だけです。12 月を越える予算には 2 行目が必要です。
Ofox 経由で呼び出す
google/gemini-3.7-flash は Ofox のカタログにあり、Google プロバイダー経路で入力 $0.75、出力 $3.75(同じモデルページの CloudVertex 経路は $1.50 / $7.50 で、/v1/models の pricing フィールドが現在返すのは後者)。https://api.ofox.ai/v1 の OpenAI 互換エンドポイントと、Google のネイティブ Gemini プロトコルの両方から到達できます。Gemini 3.8 Flash は 2026 年 9 月 3 日時点でカタログにありません。 追加されれば、Ofox 経由の移行も上と同じ文字列 1 つの変更に google/ プレフィックスが付くだけです。何を呼び出せるかの最終的な根拠は GET /v1/models の稼働中カタログです。
from openai import OpenAI
client = OpenAI(base_url="https://api.ofox.ai/v1", api_key="YOUR_OFOX_API_KEY")
for model in ["google/gemini-3.7-flash"]: # 掲載されたら "google/gemini-3.8-flash" を追加
for effort in ["low", "medium", "high"]:
r = client.chat.completions.create(
model=model,
reasoning_effort=effort,
messages=[{"role": "user", "content": "Rewrite this GROUP BY as a window function."}],
)
print(f"{model:28} {effort:7} out={r.usage.completion_tokens:6}")
自分のプロンプトで走らせて out 列を読んでください。アップグレードの判断は、実際に本番で使う effort レベルでの 3.7 Flash 行と 3.8 Flash 行の差に、100 万トークンあたり $3.75 を掛けたものです。この記事はその数字を与えられません。このループなら与えられます。
出典
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
- https://ai.google.dev/gemini-api/docs/pricing
- https://ai.google.dev/gemini-api/docs/latest-model
- https://artificialanalysis.ai/articles/gemini-3-8-flash
- https://artificialanalysis.ai/models/gemini-3-8-flash
- https://artificialanalysis.ai/models/gemini-3-7-flash
- https://ofox.ai/models/google/gemini-3.7-flash
価格、指数スコア、トークン数、速度は 2026 年 9 月 3 日に確認。Ofox カタログの掲載状況は同日に稼働中の /v1/models エンドポイントで確認し、Ofox の価格はモデルページから取得。
よくある質問
- Gemini 3.8 Flash は Gemini 3.7 Flash より高いですか?
- トークン単価では違いません。どちらも 100 万トークンあたり入力 $0.75、出力 $3.75 で 2026 年 12 月 31 日まで、2027 年 1 月 1 日から $1.50 と $7.50。キャッシュ、Batch、Flex、Priority のレートも同一です。タスクあたりでは高くなります。Artificial Analysis の計測では high effort で Intelligence Index タスクあたり 3.8 Flash が $0.58、3.7 Flash が $0.40。3.8 Flash がタスクあたり約 30% 多く出力トークンを書くためです。
- Gemini 3.8 Flash は 3.7 Flash よりどれくらい優れていますか?
- Artificial Analysis Intelligence Index で high effort なら 3 ポイント、59 対 56 です。3.8 Flash のデフォルトである medium では 57 で、3.7 Flash より 1 ポイント上、タスクあたり費用はほぼ同じ $0.41。low では 3.8 Flash は 52 で、3.7 Flash を下回ります。
- Gemini 3.7 Flash から 3.8 Flash に移行すべきですか?
- Google 自身のガイダンスは、3.7 Flash は「効率優先のワークロードに対して引き続き完全にサポートされる」というものです。high effort の 59 ポイントが必要で、タスクあたり約 45% の費用増を吸収できるなら移行を。medium で切り替えれば、3.7 Flash とほぼ同じタスクあたり費用で 57 が得られます。3.7 Flash で足りているなら、価格面で動く理由はありません。
- Gemini 3.8 Flash と 3.7 Flash の API パラメータは同じですか?
- 同じです。どちらも low、medium、high の thinking レベルを受け付け、デフォルトは medium、minimal はエラーを返します。コンテキストウィンドウは 1M トークン、出力上限は 64K トークン。モデル文字列が gemini-3.7-flash から gemini-3.8-flash に変わるだけで、リクエストの他の部分は変更不要です。
- Gemini 3.8 Flash は Ofox で使えますか?
- 2026 年 9 月 3 日時点では使えません。google/gemini-3.7-flash は Ofox のカタログにあり、Google プロバイダー経路で入力 $0.75、出力 $3.75(同じページの CloudVertex 経路は $1.50 / $7.50)、OpenAI 互換と Gemini ネイティブの両プロトコルで利用できます。3.8 Flash が追加されれば、移行は Google 直接呼び出しと同じ文字列 1 つの変更です。


