Claude Sonnet 5.5 が 2026-09-28 に出ました。単価は Sonnet 5 と同じ $2 / $10 です。
公式はこう書いています。
In our testing, it costs up to 30% less per task than its predecessor.
(タスクあたり最大30%安い)
単価が同じなのに安くなる理由を、公式はトークンとツール呼び出しの削減に置いています。
showed a third fewer tool calls and roughly half the shell runs to finish a task
手順の要る課題と、要らない課題を1つずつ用意して測りました。
手順のある課題(5回ずつ) 費用は平均 -31%。公式の「最大30%」とほぼ一致
ただし1回ごとの幅は大きく、当てにはできない
手順のない課題(3回ずつ) Sonnet 5.5 のほうが 25% 遅い
費用差は 16% どまり
検証環境: Windows 10 / Claude Code 2.1.285 を隔離導入 /
claude -p --model <ID>/
--permission-mode acceptEdits/ 全ラン設定ディレクトリ使い捨て(コールド) / 測定は 2026-09-30
測り方
課題は2つ。どちらも答えが1つに決まり、ツールを使わないと解けません。
課題A(手順のある仕事)。 orders/ 配下の5ファイルに USER=<id> AMOUNT=<数> が並び、
blocklist.txt に除外するユーザーがいる。ブロック外の AMOUNT を合計して答えを書く。
正解は 4500。一覧取得 → 各ファイル読む → 除外 → 合算 → 書き込み、と手順が要ります。
課題B(手順のない仕事)。 20行のログを読み、ERROR を含む行数を書く。正解は 7。
read → 数える → write の2〜3手で終わります。
課題Aは各5回、課題Bは各3回。毎回コールド(プロジェクトも設定ディレクトリも使い捨て)。
判定は書き出したファイルの中身。modelUsage で指定モデルが実際に使われたことも確認しました
(40回すべて正答、別モデルに落ちた回はゼロ。合計 $4.33)。
課題A: 平均では、公式どおりだった
各5回の中央値です。
| モデル | ターン(中央) | API秒 | 費用(中央) | 費用(平均) |
|---|---|---|---|---|
| Sonnet 5.5 | 5 | 10.0 | $0.0696 | $0.0793 |
| Sonnet 5 | 10 | 16.0 | $0.1108 | $0.1142 |
| Opus 5.5 | 11 | 19.8 | $0.1457 | $0.1432 |
| Opus 5 | 10 | 22.7 | $0.2168 | $0.2270 |
| Haiku 4.5 | 10 | 14.2 | $0.0424 | $0.0413 |
Sonnet 5 から 5.5 への変化です。
| 中央値 | 平均 | |
|---|---|---|
| ターン | -50% | -35% |
| 費用 | -37% | -31% |
| API時間 | -38% | -28% |
| 出力トークン | -29% | -17% |
平均 -31% は、公式の「最大30%」とほぼ一致します。 単価は据え置きなので、
差は手数の少なさから出ています。
ただし、1回ごとには当てにできない
ターン数を5回ぶん並べるとこうです。
Sonnet 5.5 5, 8, 5, 5, 12
Sonnet 5 12, 10, 10, 9, 13
5回目の Sonnet 5.5 は12ターンかかり、Sonnet 5 の最少9より多い。
時間も重なります(5.5 の最遅 22.6秒 > Sonnet 5 の最速 11.4秒)。
費用だけは重なりませんが、5.5 の最大 $0.0964 と Sonnet 5 の最小 $0.0965 の差は $0.0001 で、
接しているのと変わりません。
「次の1回が3割安くなる」とは言えません。 言えるのはまとめて何十回と回したときの平均です。
3回で切り上げていたら、中央値は -39%、平均は -29% と出ていました。
5回に増やして、中央値は -37%、平均は -31% に動きました。 その程度には揺れます。
課題B: 手順がないと、逆になった
各3回の中央値です。
| モデル | ターン | API秒 | 費用 | 出力tok |
|---|---|---|---|---|
| Sonnet 5.5 | 3, 3, 3 | 5.8 | $0.0527 | 493 |
| Sonnet 5 | 10, 2, 2 | 4.6 | $0.0631 | 169 |
Sonnet 5.5 のほうが 25% 遅く、出力トークンも多い。 費用は16%安いだけで、
その差も出力ではなくキャッシュ生成トークンの違い(5.5 が少ない)から出ていました。
削る手順が無いと、Sonnet 5.5 の強みは出ません。 素直に2ターンで終わる Sonnet 5 に、速さで負けます。
公式の主張は**「タスクあたり」**と書いてあり、その「タスク」に手数が要る、という条件付きでした。
言えないこと
- 課題は2つ、各5回と3回。 ベンチマークではありません。順位は課題で変わります
-
中央値と平均が離れます。 課題Aの費用は中央値 -37% / 平均 -31%。
どちらか一方だけを見ると誤ります - 測ったのは 2026-09-30 の1日。 混み具合で時間は動きます
-
全ランをコールドにしています。 実際の作業はキャッシュに乗るので費用はこれより下がります。
ここで見ているのは版どうしの比較であって、実請求の額ではありません - 費用は
--output-format jsonのtotal_cost_usd。プランによって請求は異なります - Opus 5.5 も課題Aで Opus 5 比 費用 中央 -33% / 平均 -37%。傾向は同じでした
まとめ
- 単価は Sonnet 5 と据え置き($2 / $10)。 安くなるかは手数が減るかで決まる
- 手順のある課題では、費用が平均 -31%。 公式の「最大30%」はほぼ再現した
-
1回ごとには当てにできない。 ターンも時間も、両モデルの幅は重なる。
効くのは回数をまとめたとき - 手順のない課題では逆に 25% 遅く、費用差は16%どまり。 差は出力ではなくキャッシュ生成トークンから
「新しいから速い・安い」ではありませんでした。 Sonnet 5.5 の値打ちは
手順を削るところにあります。自分がよく投げる仕事に削れる手数があるかで、乗り換えの効果は変わります。
関連記事
- Claude Code で選べる12モデルに同じ仕事をさせた。1年で速度は2.7倍、値段は1%しか変わらなかった — この記事と同じ測り方の、1年分の版
- Claude Opus 5.5 の「40%安い」は、キャッシュの当たり方で24%にも59%にもなった — 同じ「発表の数字」を実測で崩した回
JQITのエンジニアの95%以上は未経験からの採用です。
よければコーポレートサイトにも遊びに来てください。
エンジニア採用も行っています。もしご興味あれば覗いてみてください。
▶ 採用サイト