0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

【速報】Claude Opus 5.5 まとめ:Opus 5・Fable 5.1との比較と、移行でハマる4つの破壊的変更

0
Last updated at Posted at 2026-09-27

はじめに

2026年9月22日、Anthropic から Claude Opus 5.5 がリリースされました。
「Fable 5.1 並みの性能を、Opus 5 より安く」という位置づけのモデルです。

この記事では、Anthropic の公式発表と公式ドキュメント(1次情報)のみをもとに、次の3点を整理します。

  • Opus 5.5 のスペックと価格
  • Opus 5・Fable 5.1 とのベンチマーク/コスト比較
  • Opus 5 から移行するときにハマる破壊的変更

「結局どのモデルを使えばいいのか」を判断したい方に向けた記事です。
なお、この記事の調査と下書きには Claude Code 上の Opus 5.5 を使っています。

TL;DR

  • 価格は $4 / $20(入力 / 出力、100万トークンあたり)。Opus 5 の $5 / $25 から20%値下げ、Fable 5.1 の $10 / $50 と比べると60%安い
  • 公開ベンチマークでは Opus 5 と Fable 5.1 の両方を上回る。ただし Anthropic 自身も「実際の差はスコアほど大きくない」としている
  • 出力速度は Opus 5 比で30%以上高速。Fast mode を使うと最大2.5倍
  • effort の既定値が high → medium に変わった。何も指定しないと思考量が変わるので要注意
  • 破壊的変更が4つ。thinking 無効化不可・強制ツール使用の廃止・thinking ブロックのモデル紐付け・旧 computer use ツールの非対応

環境・前提条件

  • 対象モデル: claude-opus-5-5(2026年9月22日リリース)
  • 比較対象: claude-opus-5(旧フラッグシップ)、claude-fable-5-1(一般提供の最上位モデル)
  • 情報源: Anthropic 公式発表・Claude Platform Docs・Claude Code Docs(2026年9月27日時点)

ベンチマークの数値は Anthropic の公開値です。筆者が独自に計測したものではありません。

スペック比較表

まずは3モデルの基本スペックを並べます。

項目 Opus 5.5 Opus 5 Fable 5.1
モデルID claude-opus-5-5 claude-opus-5 claude-fable-5-1
入力価格(/MTok) $4 $5 $10
出力価格(/MTok) $20 $25 $50
キャッシュ読み取り(/MTok) $0.20 $0.50 $0.25
コンテキストウィンドウ 1M 1M 1M
最大出力 128K 128K 128K
thinking Adaptive(常時ON) Adaptive(high 以下なら無効化可) Adaptive(常時ON)
effort 既定値 medium high high
公式ドキュメント上の扱い 最新の Opus レガシーモデル 最上位モデル

注目したいのは 公式ドキュメントのおすすめが Opus 5.5 に変わった 点です。
モデル一覧ページでは「迷ったらまず Opus 5.5」と案内されています。
Fable 5.1 は「Opus 5.5 を高い effort にしても評価が足りないとき」の選択肢という位置づけです。

ベンチマーク比較

Anthropic が公開したベンチマークから、3モデル分を抜粋します。

ベンチマーク 内容 Opus 5.5 Fable 5.1 Opus 5
Terminal-Bench 4.0 エージェント型コーディング 66.4% 55.8% 52.3%
FrontierCode v1.1 (Main) エージェント型コーディング 54.4% 50.3% 48.0%
CursorBench 4.0 エージェント型コーディング 57.8% 51.8% 46.6%
GDPval-AA v2.1 知識労働 1846 1735 1708
AutomationBench 業務ワークフロー 40.0% 31.4% 26.9%
Humanity's Last Exam(ツールあり) 学際的な推論 67.7% 65.6% 63.6%
Terminal-Bench-Science 0.1 エージェント型の科学研究 58.7% 52.6% 29.0%
OSWorld 2.0 コンピュータ操作 81.8% 80.7% 74.0%
Chartography(ツールあり) グラフの読み取り 89.0% 88.4% 83.4%

公式発表の注記によると、Opus 5.5 のスコアは原則 max effort で測定されています(Terminal-Bench 4.0 は xhigh)。
既定の medium で使う場合は、この数値がそのまま出るとは限りません。
また AutomationBench の Opus 5.5 のスコアは早期アクセス時の値で、他モデルは公開リーダーボードの値です。

読み取れること

  • エージェント型コーディングで差が大きい。Terminal-Bench 4.0 では Fable 5.1 を10ポイント以上上回る
  • コンピュータ操作とグラフ読み取りは僅差。OSWorld 2.0 は1.1ポイント差、Chartography は0.6ポイント差
  • Opus 5 からは全項目で伸びている。OSWorld 2.0 は約8ポイント、AutomationBench は約13ポイント改善

Anthropic 自身も発表の中で「社内で使った実感では、Fable 5.1 との差はスコアが示すより小さい」と述べています。
自分のタスクで比較評価(eval)してから切り替えるのが安全です。

コスト比較:どれくらい安くなるのか

価格表だけでなく、具体的な金額で比べてみます。
入力100万トークン・出力20万トークンの処理を想定します。

モデル 入力コスト 出力コスト 合計
Opus 5.5 $4.00 $4.00 $8.00
Opus 5 $5.00 $5.00 $10.00
Fable 5.1 $10.00 $10.00 $20.00

単価だけで見ると Opus 5 比20%減、Fable 5.1 比60%減です。
さらに Anthropic は「既定設定で一般的なワークロードを処理した場合、Opus 5 より40%安くなる」と発表しています。

一方で、公式ドキュメントには次の注意書きもあります。

  • 同じ effort でも、Opus 5 より1ターンあたりの思考量が多くなりやすい(特に xhigh と max)
  • effort の設定を旧モデルから引き継がず、自分の評価で調整し直すこと

effort を上げるほどトークン消費も増えるため、必要な分だけ上げるのがよさそうです。

速度と Fast mode

  • 通常モードでも出力速度は Opus 5 比で 30%以上高速
  • Fast mode(リサーチプレビュー)で 最大2.5倍
  • Fast mode の価格は $8 / $40(通常の2倍)
  • API での Fast mode は Claude API のみ。Amazon Bedrock・Google Cloud・Microsoft Foundry などでは使えない

Claude Code では /fast で Fast mode を切り替えられます。
公式ドキュメントでは、素早い試行錯誤やライブデバッグのような対話的な作業に向くとされています。
なお、サブスクリプションプラン(Pro / Max / Team / Enterprise)では、Fast mode の利用分はプランの使用枠ではなく usage credits から支払われます。

文章の書き方も変わった

地味ですが、個人的に注目しているのが文章スタイルの改善です。
Anthropic の発表では、Opus 5.5 は次の点が改善されたとされています。

  • 従来のモデルより自然なコミュニケーションになった
  • 文章がより明確で、読みやすくなった
  • 最も重要な情報を先に書く

議事録や報告書の下書きを Claude に任せている方には、うれしい変化ではないでしょうか。

移行でハマる4つの破壊的変更

ここからは API を直接使っている方向けです。
Opus 5 からモデルIDを差し替えるだけだと、400エラーになるケースがあります。

1. thinking を無効化できない

Opus 5.5 では thinking が常時ONです。
thinking: {"type": "disabled"} や budget_tokens 指定はエラーになります。

# ❌ Before(Opus 5 では動いていた)
response = client.messages.create(
    model="claude-opus-5",
    max_tokens=4096,
    thinking={"type": "disabled"},
    messages=messages,
)

# ✅ After(thinking の指定は外し、effort で深さを調整する)
response = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=4096,
    output_config={"effort": "low"},
    messages=messages,
)

なぜこうするか: 以前 thinking を切っていたのは、速度とコストを抑えたかったからのはずです。
Opus 5.5 ではその役割を effort パラメータが担います。
また、レスポンスの先頭に thinking ブロックが入ることがあるため、content[0] のような位置指定ではなく type で判定しましょう。

# レスポンスからテキストだけを取り出す
for block in response.content:
    if block.type == "text":
        print(block.text)

2. 強制ツール使用(tool_choice: any / tool)が使えない

tool_choice に {"type": "any"} や {"type": "tool", "name": "..."} を渡すとエラーになります。
使えるのは auto(既定)と none だけです。

# ❌ Before
tool_choice = {"type": "tool", "name": "extract_invoice"}

# ✅ After(auto のまま、ツール定義に strict: True を付ける)
tools = [
    {
        "name": "extract_invoice",
        "description": "請求書のテキストから請求先と金額を抽出する。請求書を受け取ったら必ず使う。",
        "strict": True,
        "input_schema": {
            "type": "object",
            "properties": {
                "billing_to": {"type": "string"},
                "amount": {"type": "integer"},
            },
            "required": ["billing_to", "amount"],
            "additionalProperties": False,
        },
    }
]
tool_choice = {"type": "auto"}

なぜこうするか: 「スキーマ通りの JSON がほしい」という目的なら、strict tool use や structured outputs で代替できます。
「必ずツールを呼んでほしい」場合は、公式ドキュメントの案内どおり、プロンプトでツールを使う条件を明記します。

3. thinking ブロックがモデルと会話に紐付く

途中でモデルを切り替える構成の方は要注意です。

  • Opus 5 → Opus 5.5 への切り替え: 思考の内容は引き継がれる
  • Opus 5.5 → Fable 5.1 への切り替え: 引き継がれる(Claude API の場合)
  • Fable 5.1 → Opus 5.5 への切り替え: 引き継がれない(エラーにはならず、読めないブロックは破棄される)

さらに、2026年8月31日(UTC)以降に作成されたアカウントでは、過去の thinking ブロックより前の内容を書き換えて再送すると400エラー になります。
system プロンプトやツール定義を会話途中で編集している場合は影響を受けます。
公式ドキュメントでは、会話は追記のみにして、指示の変更は mid-conversation system messages で行うよう推奨されています。

4. 旧 computer use ツールが使えない

Claude API と Google Cloud では、computer_20251124 ツールがエラーになります。
computer_toolset_20260801 へ移行が必要です(Amazon Bedrock は旧ツールのままで動きます)。

おまけ:エラーにならないが挙動が変わる点

  • ツール呼び出しの合間のテキストが thinking ブロックで返る。既定の display: "omitted" では中身が空になるため、進捗表示をストリーミングしているアプリは途中で無言になります
  • 同じ effort でも思考量が多め。特に xhigh と max で顕著なので、max_tokens に余裕を持たせる
  • 安全分類器が追加。サイバーセキュリティに加えて生物学の分類器も動くため、拒否(stop_reason: "refusal")時のフォールバック処理を用意しておく

結局どれを使うべきか

公式ドキュメントのモデル選択ガイドをもとに整理すると、次のようになります。

やりたいこと 公式のおすすめ 例
最高性能が必要 Fable 5.1 数時間走るエージェント、多段階のディープリサーチ
複雑なエージェント型コーディング・業務 Opus 5.5 長時間の自律コーディング、大規模リファクタリング、コンピュータ操作
日常的なコーディング・エージェント Sonnet 5 コード生成、データ分析、コンテンツ作成
最小のレイテンシと価格 Haiku 4.5 リアルタイム処理、大量処理、サブエージェント

ポイントは 「モデルを変える前に effort を調整する」 ことです。
公式ドキュメントでも、モデル切り替えより effort 調整のほうが有効な場合が多いとされています。
Opus 5.5 は既定が medium なので、まずは既定のまま試し、足りなければ effort を上げる流れがおすすめです。

Claude Code ユーザー向けメモ

Claude Code の公式ドキュメントで確認できた内容です。

  • Pro・Max・Team・Enterprise プランと Anthropic API では、既定モデルが Opus 5.5 になった
  • Opus 5.5 を使うには Claude Code v2.1.280 以降 が必要
  • /model でモデルを切り替え、/effort で effort を変更できる
  • Opus 5.5 の effort 既定値は medium(Opus 5 は high)
  • Anthropic のテストでは、medium の Opus 5.5 がコーディングと知識労働の評価で high の Opus 5 と同等以上
  • /fast で Fast mode を切り替えられる(v2.1.280 以降は Opus 5.5 が Fast mode の既定モデル)

まとめ

  • Opus 5.5 は $4 / $20 で、Opus 5 より20%安く、Fable 5.1 より60%安い
  • 公開ベンチマークでは Opus 5 と Fable 5.1 の両方を上回る。ただし測定は max effort で、一部は僅差
  • effort の既定値が medium に変わった ため、思考量とコストのバランスを再確認する
  • API 利用者は 4つの破壊的変更 を確認してからモデルIDを差し替える
  • 今後数週間で Sonnet 5.5・Haiku 5.5 も登場予定と発表されているので、そちらも追ってまとめる予定です

前モデルの記事もあわせてどうぞ。

参考

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?