Opus 5.5とSonnet 5.5
完了した仕事の品質と総費用で選びます。
Claude Opus 5.5とSonnet 5.5の違いは、単価だけでは判断できません。 要件と合格条件が明確な実装や細かな修正なら、まずSonnetを基準に評価できます。原因の分からない不具合、複数サービスにまたがる変更、やり直しの負担が大きい仕事では、Opusに追加費用を払う価値があるかを確かめます。これは使い分けの提案であり、全作業に共通する順位ではありません。
Sonnetの入力・出力単価はOpusの半額ですが、キャッシュ読み取りは同額です。公開されたコーディング評価も、すべてOpusが上という結果ではありません。
公式資料の確認日:2026年9月29日。 独自のモデル比較実験は行っていません。掲載するスコアは出典のある公開結果、費用は固定token数による計算例です。この記事を公開するOmniaKeyはAPIゲートウェイを提供しており、その料金とAnthropic直結APIの料金は別です。
仕様と料金の主な違い
Opus 5.5は2026年9月22日、Sonnet 5.5は9月28日に公開されました。旧モデルとの比較はOpus 5.5とSonnet 5の比較に分けています。
| 項目 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Claude APIのモデルID | claude-sonnet-5-5 | claude-opus-5-5 |
| コンテキスト / 通常の最大出力 | 1M / 128K token | 1M / 128K token |
| 入力 → 出力 | テキスト・画像 → テキスト | テキスト・画像 → テキスト |
| APIの既定effort | high | medium |
| 思考 | Adaptive、between_toolsも利用可能 | Adaptive、常時有効 |
| 公式の遅延区分 | Fast | Moderate |
| 入力 / 出力単価 | $2 / $10 | $4 / $20 |
| キャッシュ読み取り | $0.20 | $0.20 |
価格は100万token当たりのUSDです。公式モデル一覧で容量は同じでも、長文中の情報を正しく使えるかは別途検証が必要です。入力と出力はコンテキストの制約に従います。300K出力はBatch APIのbeta機能で、通常の同期APIの上限ではありません。
どう使い分けるか
再現手順のある不具合、受け入れテスト付きの小さな機能、範囲を絞ったレビューは、Sonnetの費用対効果を確かめやすい仕事です。Opusは、原因調査が長引く障害や、互換性を慎重に守る移行で評価する候補になります。同じ資料と合格条件を渡し、修正の手間が減るかで判断します。
どちらも1Mコンテキストなので、長文では根拠への参照や重要条件の見落としを確認します。画像入力への対応は、画像を生成する機能を意味しません。高いモデルなら常に正確・安全だとも言えません。
これは費用を意識した評価方針です。Anthropicの一般的なモデルガイドは、多くの仕事でOpus 5.5から始めることを勧めています。品質優先ならその出発点も妥当です。CLI全体の選択はClaude Codeのモデル選びで整理しています。
コーディングのベンチマークを読む
以下はSonnet 5.5の発表に掲載された比較で、独自の再計測ではありません。
| 評価 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Terminal-Bench 4.0 | 70.6%(max) | 66.4%(xhigh) |
| FrontierCode 1.1 Main | 46.2%(max)、52.1%(xhigh) | 54.4% |
| CursorBench 4.0 | 55.5% | 57.8% |
| GDPval-AA v2.1 | 1844 | 1846 |
システムカード§8.5では、Terminal-Benchは66タスクを各モデル5回、計330試行ずつ実施しています。試行を独立とみなした標準誤差はSonnetが±2.5、Opusが±2.6ポイントです。Claude Codeの--bareを使い、安全機構と一部のfallbackが有効で、影響を受けた試行の割合も異なります。4.2ポイント差を、全開発作業での優位や統計的有意差に読み替えないでください。
FrontierCodeでは、Sonnetのmaxがxhighを下回っています。発表の注記によると、より頻繁なレビュー処理が、一部の分析例で時間切れや範囲外の変更につながりました。思考量を増やせば必ず良くなるわけではありません。
GDPvalは百分率ではなくスコアです。SonnetのGDPval-AAとAA-Briefcaseには、後に修正された公開前の構造化出力バグという条件もあります。個別の変更点はSonnet 5.5レビューとOpus 5.5レビューを参照してください。
API料金とキャッシュを含む費用
公式料金表の標準グローバル直結API料金です。単位はUSD / 100万token。税、ツール、地域条件、別プラットフォームの費用は含みません。
| 課金項目 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 未キャッシュ入力 | $2 | $4 |
| 課金対象出力 | $10 | $20 |
| 5分キャッシュ書き込み | $2.50 | $5 |
| 1時間キャッシュ書き込み | $4 | $8 |
| キャッシュ読み取り | $0.20 | $0.20 |
課金対象出力には思考tokenも含まれます。両モデルの最小キャッシュ対象は512 tokenですが、実際のヒットはusageで確認します。以下は同量のtokenを使う仮定であり、実測ではありません。複数リクエストの累計としても、各リクエストの上限は守る必要があります。
| 固定した処理量 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 未キャッシュ100K入力 + 20K出力 | $0.40 | $0.80 |
| 上記 + 800Kの初回5分キャッシュ書き込み | $2.40 | $4.80 |
| 未キャッシュ100K + 有効なキャッシュ読み取り800K + 20K出力 | $0.56 | $0.96 |
最後の行はSonnetが0.1 × 2 + 0.8 × 0.20 + 0.02 × 10 = $0.56、Opusが0.1 × 4 + 0.8 × 0.20 + 0.02 × 20 = $0.96。読み取り段階の差は約1.71倍で、先の書き込み料金は別に発生します。書き込みtokenを未キャッシュ入力として二重計上しないでください。
実際はtoken数も再試行数も変わります。失敗分を含む総費用を合格件数で割り、人が直した時間を別に記録すると、単価より実用的な比較になります。
速度とeffortの比較
「出力が30%以上高速」「タスク費用が最大30%低下」はSonnet 5との比較です。Opus 5.5に対する速度差でも、単価の30%値下げでもありません。Opus 5.5の約40%節約という発表も比較対象はOpus 5です。
Sonnetの既定effortはAPIでhigh、Claude Codeとappsでmedium。OpusのAPIはmediumです。同じ名前のeffortも同じ計算予算を保証しません。最初の有用な出力までと、検証を終えるまでの時間を分けて測ります。
モデルを切り替える前の確認
Sonnet移行ガイドとOpus移行ガイドの両方を確認してください。Sonnetのbetween_toolsはhigh以下で前置の思考を止めますが、すべての思考を無効化する意味ではありません。Opusはadaptive thinkingを常時使います。
両モデルとも強制tool_choiceのanyとtoolを拒否します。入出力スキーマの厳密な検証は、ツール呼び出しの強制とは別です。Thinking blocksのモデル・アカウント・会話保持ルールも守り、比較は新規会話で始めます。ツール間の進捗がthinking blocksに移り既定表示で省略される場合もあるため、無表示を停止と決めつけず、ストリームをblockの種類で処理します。
自分の仕事で比較する方法
実装、難しい調査・リファクタリング、ツール連携、文書・画像の4群から各6タスクを先に決めます。24タスク × 2モデル × 3回で144タスク実行です。これは提案で、当社が実施した試験ではありません。
commit、prompt、ツール、地域、権限、時間・ステップ制限、合格テストを固定し、毎回作業環境を戻してモデルの順番を交替します。明示的なmedium比較と、既定値・高effort比較は別集計にします。失敗、拒否、再試行、fallback、費用、時間、実際の人手修正を記録し、自己申告の完了ではなくテストで判定します。3回ではタスク別P95を精密に推定できず、成功ゼロなら成功当たり費用をゼロと表示してはいけません。
よくある質問
コーディングはSonnet 5.5のほうが上?
公開Terminal-Benchでは上ですが、掲載した他のコーディング評価はOpusが上です。設定と不確実性を含め、自分のタスクで判断してください。
Sonnetなら作業費用は必ず半分?
通常の入力・出力単価は半額でも、キャッシュ読み取りは同額です。再試行と修正によって全体の費用は変わります。
Claude Codeでは何を選ぶ?
明確な作業はSonnet、難しい調査はOpusを評価候補にできます。品質優先ならOpusから始める方法もあります。サブスクリプションとAPI課金は別なので、Claude Code料金ガイドも確認してください。
Opusのほうが長いコンテキストを使える?
この2モデルはどちらも1Mコンテキスト、通常最大128K出力です。容量より情報の使い方を検証します。
現在の提供情報と資料
OmniaKeyの料金と経路はSonnet 5.5、Opus 5.5、モデル一覧で確認できます。直結APIの計算例はゲートウェイの見積もりや実際のAPI接続試験ではありません。本文中のAnthropic公式資料は英語です。