Opus 5.5とSonnet 5
タスクの難しさと総費用からモデルを選びます。
Claude Opus 5.5とSonnet 5の選択は、作業の内容で決まります。 範囲が明確な開発には低コストのSonnet 5が出発点になります。長い調査、難しい設計判断、高くつく手戻りが中心ならOpus 5.5を試す価値があります。追加費用に見合うかは、最終的に合格した成果で判断します。
確認日:2026年9月28日。 Anthropicの現行仕様、料金、発表に基づく比較です。独自の対照ベンチマークや遅延実測は行っていません。推奨は評価の出発点であり、費用例はtoken数を固定した計算です。
仕様と料金を比較
| 項目 | Sonnet 5 | Opus 5.5 |
|---|---|---|
| 公式API model ID | claude-sonnet-5 | claude-opus-5-5 |
| コンテキスト / 標準最大出力 | 1M / 128K tokens | 1M / 128K tokens |
| 入力 / 出力 | テキスト・画像 / テキスト | テキスト・画像 / テキスト |
| 標準effort | high | medium |
| Thinking | Adaptive | Adaptive、常時有効 |
| Anthropicの遅延分類 | Fast | Moderate |
| 100万tokensの未キャッシュ入力 / 出力 | $2 / $10 | $4 / $20 |
| 100万tokensのキャッシュ読み取り | $0.20 | $0.20 |
| 出発点となる用途 | 明確・高頻度・検証可能な作業 | 難しい・開放的・失敗の影響が大きい作業 |
出典:公式仕様とAPI料金。米ドル建てのグローバル標準直結料金であり、ツール、地域指定、別モードなどは別条件です。
公称コンテキストと標準出力上限は同じです。ここでOpusに替えても大きい窓が増えるわけではありません。ある証拠をどう使うかが潜在的な差で、実タスクで確認する必要があります。
Sonnet 5から始めたい作業
範囲の決まった機能、再現できるバグ、既存インターフェースのテスト、通常のリファクタリング、対象を絞ったレビューが基準に向きます。合格条件が明確なら低価格の経路で足りるかを判断できます。
大量の作業では、1回の差がagentのステップや再試行で積み重なります。必要なファイルを渡し、検証を走らせてからモデル変更を考えてください。成功を保証する意味ではなく、どちらも欠けた要件やテスト環境を補うことはできません。
Opus 5.5を試したい作業
もっともらしい修正が根因を何度も外す、変更がサービス境界をまたぐ、移行で微妙な挙動を保つ必要がある、失敗時の修復量が大きい、といった場合に試します。証拠と合格条件はSonnetと揃えます。
AnthropicはOpus 5.5を長時間のagentコーディングや知識業務向けと位置付けています。ただしOpus 5に対する公表改善率は、Sonnet 5に対する改善率ではありません。Opus 5.5レビューでは評価条件も説明しています。
設計や診断が決まった後の通常実装は低コスト側へ戻せます。明確な作業境界で検証済みの結論を引き継ぎ、未解決の対話中に黙ってモデルを入れ替えないようにします。
すべての処理が2倍の料金になるわけではない
Opus 5.5の未キャッシュ入力と出力の単価は2倍ですが、キャッシュ読み取り単価は同じです。100万tokensの5分キャッシュ書き込みはSonnet $2.50、Opus $5、1時間では$4、$8です。
| 同じtoken量 | Sonnet 5 | Opus 5.5 |
|---|---|---|
| 未キャッシュ入力100K+課金対象出力20K | $0.40 | $0.80 |
| 未キャッシュ100K+キャッシュ入力800K+課金対象出力20K | $0.56 | $0.96 |
2行目のSonnetは0.1 × $2 + 0.8 × $0.20 + 0.02 × $10 = $0.56、Opusは0.1 × $4 + 0.8 × $0.20 + 0.02 × $20 = $0.96です。先行するキャッシュ書き込みは除外し、命中が確認されたことを仮定しています。出力には課金対象Thinking tokensも含みます。
ツール料金、再試行、プラットフォーム調整は含みません。モデルやeffortを変えるとtoken数自体も変わるため、総課金額を合格タスク数で割り、人の修正時間は別に記録します。
OmniaKeyは独立したゲートウェイ経路です。現在の提供状況と料金はOpus 5.5、Sonnet 5のモデルページを確認してください。公式料金表はゲートウェイの請求書ではなく、ClaudeのサブスクリプションもAPI従量課金とは別です。
速度とeffortはタスク全体で測る
公式分類はSonnetがFast、Opus 5.5がModerateです。これは提供者の分類であり、独自測定のtokens/秒倍率ではありません。回答が速くても、修正や再試行が多いとタスク完了は遅くなります。
まず各モデルの標準値、Sonnet highとOpus mediumで比較します。これは標準的な開始設定の比較で、同じ計算予算ではありません。同名effortも試す場合は別の試験として示し、同じtoken予算と見なさないでください。
プロンプト、リポジトリ、ツール、合格テストを固定し、最初の有用な出力、全体時間、試行回数、課金tokens、合格状況を記録します。1件の良い出力だけで普遍的な順位を決めず、代表的な複数タスクを使います。
切り替える前にAPI仕様を確認
Opus 5.5はAdaptive thinkingが必須です。Thinking無効化や手動予算はエラーになり、tool_choiceのany、toolによる強制指定も非対応です。Thinkingブロックには会話保持のルールがあり、ツール間の進捗文がその中へ入る場合もあります。
Sonnetのリクエストのmodel名だけを変えて残りの設定も有効だとは思わず、移行ガイドを読み、ツールループを実際の経路で確認します。CLI内の選択はClaude Codeモデルガイドを参照してください。
よくある質問
コーディングは常にOpus 5.5の方が上ですか?
文書だけでは普遍的な結論は出せません。Opusは難しい作業向けですが、Sonnetが安定して合格するタスクなら十分で安価な場合があります。結果、費用、修正時間を比較します。
Sonnet 5は半額ですか?
標準直結の未キャッシュ入力と出力は半額ですが、キャッシュ読み取りは同額です。全体はtoken構成、Thinking、再試行、ツールによって変わります。
Opus 5.5のコンテキストは大きいですか?
両方とも1Mコンテキスト、128K標準最大出力です。無料枠や含まれる利用量ではなく容量です。別のAPIモードには別条件があります。
以前のOpus 5比較は不要ですか?
5.5を比べる場合は本記事を使います。Opus 5とSonnet 5の比較は旧モデルの判断に残します。結果や料金を引用するときはバージョンを明示してください。