Sonnet 5.5とOpus 5.5の使い分け:どんな開発作業でOpusを試す?
バグ修正、コードレビュー、複雑な変更でSonnet 5.5とOpus 5.5を選ぶ方法。作業範囲、effort、キャッシュ料金と判断根拠を整理します。
要件が明確な開発作業ではSonnet 5.5を、判断が難しい作業、曖昧さがある作業、失敗が続く作業ではOpus 5.5も評価対象に入れましょう。 これは評価するタスクの選び方です。Sonnetなら小さな作業は必ず解ける、Opusなら大きな作業で必ず勝つという証明ではありません。合格基準はリポジトリのテストとレビュー規則です。
AnthropicはSonnetを、より速く低コストでOpusを補うモデルと位置づけ、Opusは慎重な判断が必要な複雑な仕事に適すると説明しています。ただし料金とeffortを考えると、単に「Sonnetは半額」とは決められません。2026年9月29日に確認した資料に基づくガイドであり、独自の直接比較実験ではありません。
単価だけでは選べない
| 公式Claude APIの項目 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 入力100万トークン当たり | $2 | $4 |
| 出力100万トークン当たり | $10 | $20 |
| キャッシュ読み取り100万トークン当たり | $0.20 | $0.20 |
| APIの既定effort | high | medium |
| コンテキストウィンドウ | 1Mトークン | 1Mトークン |
出典:Sonnetの仕様、Opusの仕様。提供元の単価であり、月額契約の利用枠やOfoxの見積もりではありません。リポジトリの文脈を繰り返し使う場合、キャッシュ読み取りの行が重要です。大きな共通プレフィックスをキャッシュから読む場合には、キャッシュなし入力・出力と同じ2倍の差はありません。
キャッシュ読み取り100,000トークンと課金対象出力2,000トークンが同じで、他の課金項目をすべて除いた仮想リクエストを考えます。Sonnetは0.04ドル、Opusは0.06ドルです。この例では読み取り単価が同じなので2倍にはなりません。どちらかのモデルで往復が増えれば、結果はまた変わります。
タスクを検証可能な成果に結びつける
| タスク | 比較の始め方 | 残す証拠 |
|---|---|---|
| 確実に再現できるバグ | Sonnetの控えめなeffortから始め、必要ならOpus | 失敗テスト、パッチ、回帰テスト全体 |
| 要件が明確な小機能 | Sonnetと現在使える基準構成 | 合格条件、編集範囲 |
| 原因が曖昧で複数モジュールにまたがる障害 | 最初からOpusも含める | 複数の仮説、確認ファイル、検証した原因 |
| リポジトリのレビュー | 両モデルに同じ範囲を渡す | 確認済みの指摘と誤検知 |
| リスクの高い移行 | 計画と検証を分けて比較 | 移行表、戻し方、結合テスト |
これは試験の設計であり、実測の合格率ではありません。短いパッチでも難しい推論が必要なことがあり、長い機械的変更は容易なこともあります。ファイル数や変更行数だけで難しさを判断しないでください。
ベンチマークは条件と一緒に読む
Artificial AnalysisのSonnet公開時レポートは、複数のタスクで良い結果を示す一方、maxでは出力消費が大幅に増えると報告しています。また、試験した公開前環境に構造化出力の問題があり、再測定を予定しているとしています。両モデルを試す理由にはなっても、自分の用途で最安の設定は確定できません。
Opus mediumとSonnet maxを比べて、純粋なモデル差と呼ばないでください。それは設定を含む比較です。その比較自体には価値がありますが、両方の設定と実際の予算を示す必要があります。同じeffort名でも計算量が等しいとは限りません。
Anthropicの公開告知も、各モデルの強みと評価条件を説明しています。提供元の主張、独立測定、自分の観察は分けて扱います。図の結果が食い違う理由は、課題や設定の違いかもしれません。
切り替えの基準を先に決める
実行前に停止条件を決めます。たとえば「修正案を1回作り、回帰テストを行う」です。失敗したら、再実行の前に原因を確認します。タスクを誤解していたなら、effortを上げ続けるより入力を明確にします。正しい箇所は見つけても有効な修正を作れないなら、条件を管理してOpusを試す意味があります。
新しい実行には、問題説明、関連ファイル、テスト結果を渡します。暗号化された思考ブロックがモデル間で移せるとは限りません。Sonnet 5.5のモデル・会話固有の規則は移行ガイドを参照してください。見えない推論の継続に頼らず、見える証拠を残しましょう。
最初の試行と切り替え後の費用はまとめて記録します。最初の失敗を片方に、最後の成功だけをもう片方に付けると、ルーティングが実際より安く見えます。コンパイルできても大幅な手直しが必要なパッチは完成とはいえないので、レビュー時間も記録してください。
月額契約で使う場合
API料金表からClaude Codeで送れるプロンプト数を正確に割り出すことはできません。利用枠や上限はアカウントとサービス条件によります。クライアント更新や提供事業者の変更後は、選択中のモデルを確認し、課金方式とモデル名を区別してください。
Claude Code設定ガイドではバージョン確認と明示的なモデル選択を説明しています。EffortガイドはAPIとClaude Codeの既定値を区別しています。他社モデルも試す場合はSonnetとSolの比較方法を利用できます。
よくある質問
- Sonnetは常にOpusの半額ですか?
- いいえ。キャッシュなし入力・出力の公示単価は半分ですが、キャッシュ、使用量、再試行、ツールで完了費用は変わります。上の例は、その差を分けて示したものです。
- コードレビューは必ずOpusにすべきですか?
- 資料から一律の規則は導けません。代表的なレビューで、確認できた指摘と誤検知、それぞれを人が確認する時間を比較してください。
- 同じ会話をモデル間で移せますか?
- 可視メッセージを引き継ぐ対応ワークフローはありますが、思考ブロックには互換性規則があります。隠れた状態をすべて移せると考えず、移行資料を確認してください。


