GPT-6 SolのAPI料金:キャッシュと長い入力の計算方法
GPT-6 Solの入力・出力・キャッシュ料金を整理。272K超の入力に適用される条件と、検算できる費用表・計算スクリプトを紹介します。
GPT-6 SolのOpenAI直接契約APIでは、Standardの短い入力に対する通常入力が100万トークン当たり2米ドル、出力が10米ドルです。 ただし、キャッシュと入力長、処理モードを無視すると請求額を正しく見積もれません。
モデルページと料金文書を2026年9月23日に確認しました。以下は100万テキストトークン当たりの米ドル建て料金で、Ofoxの料金やサブスクリプション枠ではありません。
入力が272Kを超えたらリクエスト全体で切り替わる
| Standard | 通常入力 | キャッシュ読み取り | キャッシュ書き込み | 出力 |
|---|---|---|---|---|
| 入力272K以下 | 2 | 0.20 | 2.50 | 10 |
| 入力272K超 | 4 | 0.40 | 5 | 15 |
長い入力の料金は、超過分だけでなくリクエスト全体に適用されます。モデルの最大コンテキスト容量と、料金が変わる境界は別です。
BatchとFlexは該当するStandard料金の半額、Fastは2倍です。別々のモードを自由に組み合わせて割引を重ねることはできません。対応する地域処理では追加料金も確認し、現在のEUデータレジデンシーはStandardのみという条件も考慮します。実際に使ったモードで計算してください。
キャッシュ書き込みを通常入力にも重ねない
キャッシュ文書に合わせ、通常入力、読み取り、書き込みを重複しない区分にします。同じトークンを通常入力と書き込みの両方で数えないようにします。
費用 = (通常入力 × 入力単価 + 読み取り × 読み取り単価
+ 書き込み × 書き込み単価 + 課金対象出力 × 出力単価) / 1,000,000
利用量データに総入力とキャッシュの内訳がある場合は、各フィールドの定義を確認して分けます。出力には該当する推論トークンも含め、画面に見えた文字だけを数えないでください。
固定したトークン数で検算する
通常入力20,000、読み取り60,000、書き込み20,000、出力5,000のStandardリクエストを仮定します。これは実測ではなく、重複のない数量による計算例です。
| 区分 | 計算 | 米ドル |
|---|---|---|
| 通常入力 | 20,000 × 2 / 1M | 0.040 |
| 読み取り | 60,000 × 0.20 / 1M | 0.012 |
| 書き込み | 20,000 × 2.50 / 1M | 0.050 |
| 出力 | 5,000 × 10 / 1M | 0.050 |
| 合計 | 各区分の合計 | 0.152 |
CSVの料金・計算表とPython計算スクリプトで検算できます。スクリプトは通信せず、実際の請求やキャッシュ命中率を取得しません。
通常入力300,000、出力5,000でキャッシュを使わない場合は、長い入力の料金で 0.3 × 4 + 0.005 × 15 = 1.275米ドル です。適用される追加料金は別です。最初の272Kだけ安い単価を使う計算は過小見積もりになります。
単価が半額でも作業費用は半額とは限らない
発表では、旧GPT-5.6 Solのプロモーション価格である入力4・出力20米ドルと、新しい2・10米ドルを比較しています。この2項目の単価は50%低下しています。
一方、実際の作業では入力、推論、ツール、再試行が変わります。過去の請求には当時の料金を残し、新料金での再計算は仮定として分けてください。単価の比較だけでは、同じ合格条件を満たす総費用は分かりません。
合格した作業単位で記録する
モデルID、事業者、処理モード、入力長、キャッシュ内訳、出力、ツール費用、合格結果を保存します。失敗した試行も含め、捨てた回答の費用を集計から落とさないようにします。
SolとOpus 5.5の比較では同じ数量での計算を、GPT-6の選び方では評価の始め方を扱います。ゲートウェイを使う場合は、その経路の実際の料金を確認してください。
よくある質問
- 272Kを超えた分だけ高くなりますか?
- いいえ。入力が272Kを超えると、リクエスト全体に該当する長い入力の料金が適用されます。
- キャッシュ書き込みには通常入力料金も加算しますか?
- 同じトークンを重複して数えません。書き込みとして課金される数量は通常入力と分けて扱います。
- 単価が半額なら作業費用も半額ですか?
- トークン数、ツール、再試行、合格率が変わるため、必ず半額になるとは限りません。


