0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

Claude Opus 5リリース — Fable 5に迫る性能を半額で、thinkingデフォルトON化で破壊的変更も

0
Posted at

3行まとめ

  • 2026年7月24日、Anthropic が Claude Opus 5(モデルID: claude-opus-5)をリリース。価格は Opus 4.8 と同じ $5 / $25 per MTok のまま、Fable 5($10/$50)に肉薄する性能を半額でという位置づけ
  • thinking がデフォルトON化(Opus 4.8 は明示しない限りOFF)。さらに thinking: {type: "disabled"}effort が high 以下のときのみ許可xhigh/max と組み合わせると 400エラーという新しい制約が入った
  • 新機能は3つ。会話途中でツール構成をキャッシュを壊さず変更できるミッドセッションツール変更(beta)、安全性分類器に引っかかったリクエストを自動で別モデルに逃がす Automatic Fallbacks の "default" モード、プロンプトキャッシュの最小長引き下げ(1024→512トークン)

Opus 4.8 のデフォルト昇格から2ヶ月足らずで、Anthropic が Claude 5 ファミリー4番目のモデルとして Claude Opus 5 を公開した。Fable 5・Mythos 5・Sonnet 5に続く投入で、これで Haiku 以外の全ラインが5シリーズに揃った形になる。

「Fable 5 に迫る性能を半額で」という触れ込み通り、価格は据え置きなのに性能だけ底上げされたリリースだが、thinking のデフォルト挙動が変わったことで、Opus 4.8 からの単純なモデルID差し替えでは済まないケースがある。開発者向けドキュメントと複数の報道を突き合わせて、変更点を整理しておく。

基本仕様

開発者向けドキュメント(What's new in Claude Opus 5)の記載はこう。

  • モデルID: claude-opus-5
  • コンテキストウィンドウ: 1Mトークン(デフォルトかつ最大。小さいバリアントは存在しない)
  • 最大出力トークン: 128K(Batch API では output-300k-2026-03-24 ベータヘッダーで300Kまで拡張可能)
  • 価格: 入力 $5 / 出力 $25 per MTok(Opus 4.8 と同額)
  • Fast mode: 入力 $10 / 出力 $50 per MTok(標準価格の2倍)、Claude API 限定(Bedrock・Google Cloud・Microsoft Foundry では現状非対応)

提供プラットフォームは Claude API(claude-opus-5)に加え、Amazon Bedrock(anthropic.claude-opus-5)・Google Cloud(claude-opus-5)・Microsoft Foundry。Opus 4.8 はこれら全プラットフォームで併存し、即時廃止にはなっていない。

claude.ai 側では Claude Max の新デフォルトモデルClaude Pro での最強モデルという扱いになった。

Fable 5・Mythos 5との位置づけ

Claude 5 ファミリーの中での立ち位置が今回のリリースでかなり明確になった。

  • Fable 5 との関係: 「半額でFable 5に肉薄」が基本コンセプト。CursorBench 3.2 では最大 effort 時に Fable 5 の0.5%以内の性能差、OSWorld 2.0 では Fable 5 と同等の結果を3分の1のコストで達成したと報告されている(単価自体は半額だが、このベンチマークではトークン消費効率も含めた実測値として3分の1になっている)
  • Mythos 5 との関係: サイバーセキュリティの「脆弱性発見」段階(OSS-Fuzz等)は同等だが、「エクスプロイト開発」段階では明確に劣後。Anthropic はこの差を意図的な安全設計としている
  • Opus 4.8 との関係: 同価格のまま Frontier-Bench で2倍以上のスコア、化学・生物系の評価でも大幅な伸び

TechCrunch はこの構図を「Fable より安価で制約も緩い」と評している。

新機能3つ

ミッドセッションツール変更(beta)

会話のターン間でツールの追加・削除を、プロンプトキャッシュを無効化せずに行える。従来はセッション開始時に固定したツールリストを最後まで使い回す必要があったが、ベータヘッダー mid-conversation-tool-changes-2026-07-01 を付けることで途中変更が可能になった。長時間の agentic セッションでツールセットを動的に絞り込みたい場面で効く。

Automatic Fallbacks の "default" モード

fallbacks パラメータに新しい "default" モードが追加された。従来(server-side-fallback-2026-06-01 ヘッダー)はフォールバック先のモデルリストを自分で明示する必要があったが、server-side-fallback-2026-07-01 ヘッダーを使うと、拒否カテゴリごとに Anthropic が推奨するフォールバックモデルを自動適用できるようになる。API利用時、安全性分類器に引っかかったリクエストがエラーで終わる代わりに、機能的なレスポンスを返せるようになる。

プロンプトキャッシュの最小長引き下げ

キャッシュ可能な最小プロンプト長が、Opus 4.8 の1,024トークンから 512トークンに引き下げられた。これまでキャッシュ対象にならなかった短いプロンプトも、コード変更なしでキャッシュエントリを作れるようになる。

破壊的変更 — thinkingのデフォルトON化

今回のリリースでいちばん実務に効くのがここ。

① thinkingがデフォルトで有効に

Opus 4.8 では thinking フィールドを指定しなければ思考なしで動いていたが、Opus 5 では同じリクエストが thinking 有効で動く。ワイヤー上の値は変わっておらず、thinking: {type: "adaptive"} は引き続き有効かつデフォルトと等価な指定として使える。

max_tokens は思考トークン+応答テキストの合計に対する上限なので、Opus 4.8 で thinking なし前提でギリギリの max_tokens を設定していたワークロードは、思考分を食われて応答が途中で切れる可能性がある。

thinking: disabled は effort high 以下限定に

これが正式な破壊的変更として明記されている。thinking: {type: "disabled"} は effort が high 以下のときのみ受け付けられ、xhigh または max と組み合わせると400エラーになる。Opus 4.8 では thinking の有効・無効と effort レベルは独立していたが、Opus 5 ではこの組み合わせが制約された。

# Opus 5では400エラー
client.messages.create(
    model="claude-opus-5",
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},
    ...
)

# thinkingを無効にしたいなら、effortをhigh以下に落とす
client.messages.create(
    model="claude-opus-5",
    thinking={"type": "disabled"},
    output_config={"effort": "high"},
    ...
)

thinking を無効にした状態では、Opus 5 がツール呼び出しを tool_use ブロックではなくテキスト出力内に書いてしまったり、内部用のXMLタグが応答に混ざったりすることがあるとドキュメントに明記されている。基本的には thinking を有効にしたまま effort で調整するのが推奨で、どうしても無効にしたい統合ではプロンプト側の緩和策が必要になる。

③ 挙動の変化(コード変更は不要だが要注意)

  • 応答が長くなる傾向。デフォルトのユーザー向け応答・成果物が総じて長めになる
  • 進捗ナラティブが増える。agentic セッション中の途中経過報告が増加
  • サブエージェントへの委譲がより積極的になる
  • 指示しなくても自己検証するようになった。「最後に検証ステップを入れて」「サブエージェントで確認させて」といった旧モデル向けの指示が、Opus 5では過剰検証を誘発する要因になる。移行時はこの手のプロンプトを棚卸しして削る価値がある

effort の重みが増した

low / medium / high / xhigh / max のフルラダーが使え、デフォルトは high。ドキュメントでは「どのOpusモデルよりも確実に追加effortを結果に変換する」と説明されており、effort の選択がこれまで以上に効いてくる。xhighmax で実行する場合は max_tokens を大きめに確保しておく必要がある。

ベンチマーク実測

公式発表で挙げられている主な数値。

  • Frontier-Bench v0.1: 全モデル中最高、Opus 4.8の2倍以上
  • ARC-AGI 3: 次点モデルの3倍のスコア
  • Zapier AutomationBench: 次点比1.5倍のパス率
  • 有機化学タスク: Opus 4.8比 +10.2ポイント
  • タンパク質関連タスク: Opus 4.8比 +7.7ポイント

安全性面では ASL-3(化学・生物リスク起因)は Opus 4.8 から据え置きだが、安全性分類器の発火頻度は Fable 5 比で85%少なくなる見込みとされている。

個人開発者向け移行チェックリスト

Opus 4.8 の API 利用がある場合、モデルIDを差し替える前に確認したい項目。

  1. モデル文字列を claude-opus-4-8claude-opus-5 に変更
  2. thinking: {type: "disabled"}effort: xhigh/max と併用していないか確認。していれば400エラーになるので、effortをhigh以下に落とすか、thinkingを有効なままにする
  3. max_tokens を見直す。thinkingがデフォルトONになった分、思考トークンに食われる余地を確保する
  4. 「検証ステップを入れて」系のプロンプトを棚卸し。Opus 5は指示なしで自己検証するため、過剰検証の原因になりやすい
  5. Fast mode を使っている場合はプラットフォームを確認。現状 Claude API 限定で、Bedrock・Google Cloud・Microsoft Foundry は非対応

Claude Code や claude.ai 側は特に何もしなくても新モデルの恩恵を受けられるが、API を直接叩いている場合はこのチェックリストを一通り確認しておきたい。

まとめ

Opus 5 を一言でまとめると、「価格据え置きでFable 5に肉薄する性能を持ってきた代わりに、thinkingまわりの挙動とeffortの制約を変えたリリース」

  • 価格は Opus 4.8 と同額($5/$25 per MTok)のまま性能は大幅向上
  • thinkingがデフォルトON化。disabledeffort: high以下限定という新制約
  • ミッドセッションツール変更・Automatic Fallbacks・キャッシュ最小長引き下げの3新機能

ウォッチポイントは、thinking: disabled × xhigh/max の組み合わせを使っているコードが手元にないかという一点に尽きる。ここを見落とすと、Opus 4.8時代に動いていたリクエストがOpus 5への切り替えだけで400エラーになる。

ぱんだツールズ では PDF・画像・CSV・テキスト処理などの開発者向けツールを 90 個以上公開中。全部無料・登録不要・ブラウザ完結で使える。Claude Code で開発した個人開発プロダクトの実例として、よかったら覗いていって。
https://sakutto-panda.com


この記事は Zenn にも同じ内容を投稿しています。

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?