結論: Sonnet 5.5 が出ました。料金は Sonnet 5 と同じで、Opus 5.5 の半分(キャッシュ読み出しを除く)です。速さと料金を優先する作業は Sonnet 5.5、難しい作業は Opus 5.5、と使い分けるのがよいと考えます。
この記事の計算・図・原稿は Claude Code と一緒に作りました。問いの立て方と数字の確認は私が行っています。
9月28日に Claude Sonnet 5.5 が出ました。以前、Opus 5.5 の料金について書いた記事「Opus 5.5 の登場で使い方によってはSonnet5よりもお得!」があります。この記事は、その続きとして、Sonnet 5.5 と Opus 5.5 の使い分けを料金から整理し直したものです。
訂正: 前回の記事は、Sonnet 5 の料金を入力 $3・出力 $15 として計算し、「キャッシュ読み出しの割合が高いと Opus 5.5 の方が Sonnet 5 より安くなる」と書いていました。これは誤りでした。公式の料金表では、Sonnet 5 は発売時に期間限定とされた入力 $2・出力 $10 が標準価格に確定していて、9月1日に予定されていた値上げは行われていません。前回の記事の結論は、この記事で置き換えます。
注意点: この記事の計算は、どちらのモデルでも同じ作業に同じトークン数がかかると仮定しています。実際にはモデルを替えればトークン数も変わります。Anthropic は、Sonnet 5.5 が同じ作業で Sonnet 5 より最大30%安く済み、Opus 5.5 は Opus 5 より使うトークンが少ないと説明しています。ただし、Sonnet 5.5 と Opus 5.5 を同じ作業で比べたトークン数の違いは、この計算には入れていません。
用語
この記事では次の言葉を使います。
- キャッシュ書き込み: 会話の先頭部分を、次の呼び出しで再利用できるように保存するときに課金されるトークン。この記事では保存期間5分の料金で計算します
- キャッシュ読み出し: 保存済みの先頭部分を再利用したときに課金されるトークン
- キャッシュ読み出しの割合: 入力・出力・キャッシュ書き込み・キャッシュ読み出しの4種類を合計したトークン数のうち、キャッシュ読み出しが占める割合
- 残りの部分: キャッシュ読み出し以外の3種類(入力・出力・キャッシュ書き込み)が混ざった部分
- 実効単価: 4種類のトークンを実際の比率で混ぜたときの、100万トークンあたりの料金
Sonnet 5.5 の料金
Sonnet 5.5 の料金は、Sonnet 5 とすべての項目で同額です。公式の料金表から、Sonnet 5.5 と Opus 5.5 を並べます。単位は100万トークンあたりのドルで、キャッシュ書き込みは保存期間5分の料金です。
| 項目 | Sonnet 5.5(Sonnet 5 も同額) | Opus 5.5 | Opus 5.5 ÷ Sonnet 5.5 |
|---|---|---|---|
| 入力 | 2.00 | 4.00 | 2.0 倍 |
| 出力 | 10.00 | 20.00 | 2.0 倍 |
| キャッシュ書き込み | 2.50 | 5.00 | 2.0 倍 |
| キャッシュ読み出し | 0.20 | 0.20 | 1.0 倍 |
Sonnet 5.5 の入力と出力は、Sonnet 5 が発売時に8月末までの期間限定価格としていた額と同じで、そのまま標準価格になりました。値上げが行われなかったので、9月以降も、以前の水準から上がっていません。
Opus 5.5 は、入力・出力・キャッシュ書き込みが Sonnet 5.5 のちょうど2倍で、キャッシュ読み出しだけが同額です。前の世代の Opus 5 は、入力 $5・出力 $25・キャッシュ読み出し $0.50 だったので、Opus 5.5 は2割から6割安くなっていますが、Sonnet との序列は変わっていません。
実効単価の差
Claude Code のような長い作業では、トークンの9割以上がキャッシュ読み出しになります。そのため、実際の請求額の差は、キャッシュ読み出しの割合で決まります。キャッシュ読み出しの割合を c、残りの部分を Sonnet 5.5 の料金で計算したときの加重平均単価を r と書くと、100万トークンあたりの実効単価は次のようになります。
Sonnet 5.5 : 0.20 × c + r × (1 − c)
Opus 5.5 : 0.20 × c + 2 × r × (1 − c)
キャッシュ読み出しの分が同額なので、差は r × (1 − c) だけです。c が高いほど差は縮みますが、c が 100% にならない限りなくなりません。
例として、残りの部分が、キャッシュ書き込み9割・出力1割でできている場合を考えます。このとき r は 0.9 × 2.50 + 0.1 × 10.00 = 3.25 です。キャッシュ読み出しの割合ごとに、Opus 5.5 の実効単価が Sonnet 5.5 の何倍になるかを並べます。
| キャッシュ読み出しの割合 | Sonnet 5.5 | Opus 5.5 | 倍率 |
|---|---|---|---|
| 90% | 0.505 | 0.830 | 1.64 倍 |
| 95% | 0.353 | 0.515 | 1.46 倍 |
| 97% | 0.292 | 0.389 | 1.33 倍 |
| 99% | 0.231 | 0.263 | 1.14 倍 |
参考までに、私が Claude Code を使ったときのキャッシュ読み出しの割合は 97.1% でした。この割合の使い方なら、Opus 5.5 の実効単価は Sonnet 5.5 の約1.3倍です。倍率は残りの部分の内訳でも変わります。97% のとき、残りの部分が「すべて入力」なら 1.24 倍、「すべて出力」なら 1.61 倍です。図2の灰色の帯が、この範囲です。
使い分けの目安
料金だけで見ると、Sonnet 5.5 がどの割合でも安く、Opus 5.5 との差は割合が高いほど縮みます。使い分けの材料は、公式ドキュメントにある次の点です。
| 観点 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 位置づけ | 速さと賢さのバランス | 長時間のエージェント的な開発や、知識を使う作業向け |
| 応答の速さ(相対) | 速い | 中程度 |
| 料金 | 基準 | キャッシュ読み出しを除いて 2 倍 |
公式の位置づけと相対的な速さを、使い分けに置き直すと、次のようになります。
- 応答の速さや料金を優先する作業、たとえば定型的な修正や、量の多い下調べ、繰り返しの作業は、Sonnet 5.5 を選ぶ理由があります。
- 長い時間をかけて進めるエージェント的な作業や、難しい判断を要する作業は、Opus 5.5 を選ぶ理由があります。キャッシュ読み出しの割合が高い長い作業では、単価の差は 1.1〜1.5 倍程度にとどまるので、やり直しが減るなら取り戻せる可能性があります。
どちらがどの作業に向くかは、この計算からは分かりません。作業の中身で変わるので、同じ作業を両方で試して、費用と出来を見比べてください。
計算の前提と限界
料金は API の定価で計算しており、Batch API の割引と、保存期間1時間のキャッシュ書き込みは計算に入れていません。
Pro や Max のような定額プランで使っている場合、ここでのドルは定価に換算した参考値です。定額プランで実際に上限を決めるのは利用枠の方で、モデルごとに利用枠の減り方が違うかどうかは、この計算からは分かりません。
性能の差も、この計算には入っていません。この記事から言えるのは、料金の面では Sonnet 5.5 が Opus 5.5 より常に安く、その差はキャッシュ読み出しの割合が高いほど縮む、というところまでです。
キャッシュ読み出しの割合の調べ方
Claude Code を使っているなら、Node.js で動く集計ツールの ccusage で調べられます。手元に残っている Claude Code の利用記録を読み込んで、日ごとのトークン数を表にしてくれます。
npx ccusage@latest daily
表には Input・Output・Cache Create・Cache Read の4列が出ます。Cache Read の値を4列の合計で割れば、キャッシュ読み出しの割合になります。API を直接呼んでいる場合は、応答の usage に同じ4つの値が入っているので、それを記録して合計すれば同じ計算ができます。

