5
1

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

Claude Sonnet 5.5 の「最大30%安い」は、手順のある仕事でだけ再現した

5
Last updated at Posted at 2026-09-30

Claude Sonnet 5.5 が 2026-09-28 に出ました。単価は Sonnet 5 と同じ $2 / $10 です。
公式はこう書いています。

In our testing, it costs up to 30% less per task than its predecessor.
(タスクあたり最大30%安い)

単価が同じなのに安くなる理由を、公式はトークンとツール呼び出しの削減に置いています。

showed a third fewer tool calls and roughly half the shell runs to finish a task

手順の要る課題と、要らない課題を1つずつ用意して測りました。

手順のある課題(5回ずつ)  費用は平均 -31%。公式の「最大30%」とほぼ一致
                           ただし1回ごとの幅は大きく、当てにはできない

手順のない課題(3回ずつ)  Sonnet 5.5 のほうが 25% 遅い
                           費用差は 16% どまり

検証環境: Windows 10 / Claude Code 2.1.285 を隔離導入 / claude -p --model <ID> /
--permission-mode acceptEdits / 全ラン設定ディレクトリ使い捨て(コールド) / 測定は 2026-09-30


測り方

課題は2つ。どちらも答えが1つに決まり、ツールを使わないと解けません。

課題A(手順のある仕事)。 orders/ 配下の5ファイルに USER=<id> AMOUNT=<数> が並び、
blocklist.txt に除外するユーザーがいる。ブロック外の AMOUNT を合計して答えを書く。
正解は 4500。一覧取得 → 各ファイル読む → 除外 → 合算 → 書き込み、と手順が要ります。

課題B(手順のない仕事)。 20行のログを読み、ERROR を含む行数を書く。正解は 7。
read → 数える → write の2〜3手で終わります。

課題Aは各5回、課題Bは各3回。毎回コールド(プロジェクトも設定ディレクトリも使い捨て)。
判定は書き出したファイルの中身。modelUsage で指定モデルが実際に使われたことも確認しました
(40回すべて正答、別モデルに落ちた回はゼロ。合計 $4.33)。


課題A: 平均では、公式どおりだった

各5回の中央値です。

モデル ターン(中央) API秒 費用(中央) 費用(平均)
Sonnet 5.5 5 10.0 $0.0696 $0.0793
Sonnet 5 10 16.0 $0.1108 $0.1142
Opus 5.5 11 19.8 $0.1457 $0.1432
Opus 5 10 22.7 $0.2168 $0.2270
Haiku 4.5 10 14.2 $0.0424 $0.0413

Sonnet 5 から 5.5 への変化です。

中央値 平均
ターン -50% -35%
費用 -37% -31%
API時間 -38% -28%
出力トークン -29% -17%

平均 -31% は、公式の「最大30%」とほぼ一致します。 単価は据え置きなので、
差は手数の少なさから出ています。


ただし、1回ごとには当てにできない

ターン数を5回ぶん並べるとこうです。

Sonnet 5.5    5, 8, 5, 5, 12
Sonnet 5     12, 10, 10, 9, 13

5回目の Sonnet 5.5 は12ターンかかり、Sonnet 5 の最少9より多い。
時間も重なります(5.5 の最遅 22.6秒 > Sonnet 5 の最速 11.4秒)。
費用だけは重なりませんが、5.5 の最大 $0.0964 と Sonnet 5 の最小 $0.0965 の差は $0.0001 で、
接しているのと変わりません。

「次の1回が3割安くなる」とは言えません。 言えるのはまとめて何十回と回したときの平均です。

3回で切り上げていたら、中央値は -39%、平均は -29% と出ていました。
5回に増やして、中央値は -37%、平均は -31% に動きました。 その程度には揺れます。


課題B: 手順がないと、逆になった

各3回の中央値です。

モデル ターン API秒 費用 出力tok
Sonnet 5.5 3, 3, 3 5.8 $0.0527 493
Sonnet 5 10, 2, 2 4.6 $0.0631 169

Sonnet 5.5 のほうが 25% 遅く、出力トークンも多い。 費用は16%安いだけで、
その差も出力ではなくキャッシュ生成トークンの違い(5.5 が少ない)から出ていました。

削る手順が無いと、Sonnet 5.5 の強みは出ません。 素直に2ターンで終わる Sonnet 5 に、速さで負けます。
公式の主張は**「タスクあたり」**と書いてあり、その「タスク」に手数が要る、という条件付きでした。


言えないこと

  • 課題は2つ、各5回と3回。 ベンチマークではありません。順位は課題で変わります
  • 中央値と平均が離れます。 課題Aの費用は中央値 -37% / 平均 -31%。
    どちらか一方だけを見ると誤ります
  • 測ったのは 2026-09-30 の1日。 混み具合で時間は動きます
  • 全ランをコールドにしています。 実際の作業はキャッシュに乗るので費用はこれより下がります。
    ここで見ているのは版どうしの比較であって、実請求の額ではありません
  • 費用は --output-format json の total_cost_usd。プランによって請求は異なります
  • Opus 5.5 も課題Aで Opus 5 比 費用 中央 -33% / 平均 -37%。傾向は同じでした

まとめ

  • 単価は Sonnet 5 と据え置き($2 / $10)。 安くなるかは手数が減るかで決まる
  • 手順のある課題では、費用が平均 -31%。 公式の「最大30%」はほぼ再現した
  • 1回ごとには当てにできない。 ターンも時間も、両モデルの幅は重なる。
    効くのは回数をまとめたとき
  • 手順のない課題では逆に 25% 遅く、費用差は16%どまり。 差は出力ではなくキャッシュ生成トークンから

「新しいから速い・安い」ではありませんでした。 Sonnet 5.5 の値打ちは
手順を削るところにあります。自分がよく投げる仕事に削れる手数があるかで、乗り換えの効果は変わります。


関連記事


JQITのエンジニアの95%以上は未経験からの採用です。
よければコーポレートサイトにも遊びに来てください。

▶ コーポレートサイト

エンジニア採用も行っています。もしご興味あれば覗いてみてください。

▶ 採用サイト

5
1
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
5
1

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?