0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

【2026年6月】Claude Fable 5がリリース!Mythosクラス初の一般公開・ベンチマーク・API利用まとめ

0
Posted at

はじめに

2026年6月9日、Anthropicが新世代モデル Claude Fable 5 を発表しました。これは2026年4月に限定公開された最上位ティア「Mythosクラス」のモデルが、一般ユーザー向けに提供される初めてのケースです。

Mythosクラスは従来のフラッグシップである Opus クラスのさらに上位に位置づけられるモデル群で、これまで Claude Mythos Preview として一部のサイバーセキュリティ事業者・重要インフラ提供者など限られた組織にしか開放されていませんでした。今回、新たな安全装置(セーフガード)の整備によって、その能力を一般公開できる水準に達したというのが今回のリリースの核心です。

最大のポイントは「長く複雑なタスクほど他モデルに差をつける」という点。大規模なコードベース移行、数日にわたるエージェント実行、深いリサーチや高度なナレッジワークなど、これまでのモデルでは破綻していたような長時間タスクで真価を発揮します。

本記事では、開発者・エンジニア向けに Claude Fable 5 の概要、ベンチマーク、API利用時の注意点を整理します。


モデルスペック

項目 Claude Fable 5
モデルID(API) claude-fable-5
モデルクラス Mythosクラス(Opusの上位)
リリース日 2026年6月9日
コンテキストウィンドウ 1,000,000トークン
入力 テキスト / 画像 / ファイル
出力 テキスト(推論サポートあり)
入力価格 $10 / 1Mトークン
出力価格 $50 / 1Mトークン
プロンプトキャッシュ 入力トークン90%割引
提供形態 Claude API / Amazon Bedrock / Google Cloud Vertex AI / Microsoft Foundry

価格は Claude Opus 4.8 の約2倍(Opus 4.8は入力$5 / 出力$25)ですが、限定公開だった Claude Mythos Preview と比べると半分以下に抑えられています。

なお Claude Fable 5 は、ヴェット済み(審査済み)パートナー向けに限定提供される **Claude Mythos 5 と同一のモデル(同じ重み)**です。両者の違いはセーフガードの有無のみで、Fable 5 は「一般公開向けに安全装置を付けた版」という位置づけになります(後述)。

補足:Fable はラテン語の fabula(語られるもの)に由来し、ギリシャ語の mythos と同根の言葉です。安全装置が両モデルを分けるただ一つの違いであるため、別々の名前が付けられています。


主要な特徴・新機能

1. 長時間・非同期タスクの実行能力

Fable 5 の最大の強みは、過去のどのClaudeモデルよりも長く自律的に動作できる点です。Anthropicは「タスクが長く複雑になるほど、Fable 5の他モデルに対するリードは大きくなる」と説明しています。

象徴的な事例として、Stripe による早期テストでは、5,000万行規模のRubyコードベースの全体移行を1日で完了したと報告されています。これは人間のチームが手作業で行えば2ヶ月以上かかる規模の作業でした。

短い一発質問では差を感じにくい一方、数時間・数十ステップを要する問題を渡すと差が顕著になる、というのが特徴です。

2. コーディング性能の大幅向上 ⭐

エージェント型コーディングが今回の目玉です。

  • SWE-bench Pro: Opus 4.8 比で約+11ポイント
  • FrontierCode(Diamond): Opus 4.8 比で2倍以上のスコアを、medium effort(中程度の推論量)でも達成
    medium effort でも高スコアが出るという点は重要で、最大限の推論トークンを消費せずとも強い結果が得られることを意味します。

3. ビジョン(画像理解)がSOTAに

Fable 5 はビジョン関連タスクで新たな state-of-the-art を記録しました。詳細な科学図表から正確な数値を抽出したり、スクリーンショットだけからWebアプリのソースコードを再構築するといった複雑なタスクをこなします。

象徴的なデモとして、従来モデルが補助ツール(ハーネス)を必要としたゲーム「ポケモン ファイアレッド」を、生のゲーム画面(スクリーンショット)のみでクリアしたことが挙げられています。

4. メモリ・長文コンテキストの強化

数百万トークン規模の長時間タスクでも集中力を保ち、自身のメモ(ノート)を使って出力を改善していく能力を持ちます。

デッキ構築ゲーム「Slay the Spire」を使った評価では、ファイルベースの永続メモリを与えたときの性能向上幅が Opus 4.8 の3倍に達したと報告されています。

5. ナレッジワーク・科学研究での高い性能

複雑な分析タスクでも強さを発揮します。Hebbiaのファイナンスベンチマーク(上級者レベルの推論)で全モデル中最高スコアを記録し、文書ベース推論、チャート・表の解釈、問題解決の各領域で大幅な向上が見られました。


ベンチマーク結果

Anthropicが公開した主要ベンチマークの抜粋です。

ベンチマーク Fable 5 / Mythos 5 Opus 4.8 GPT-5.5 Gemini 3.1 Pro
SWE-bench Verified 95.0% 88.6% 82.6%
SWE-bench Pro 80.3% 69.2% 58.6% 54.2%
FrontierCode(Diamond) 29.3% 13.4%
Terminal-Bench 2.1 88.0% 82.7% 83.4% 70.7%
GDPval-AA(Elo) 1932 1890 1769 1314
空間推論 38.6% 14.5%
法務推論(Legal) 13.3% 10.4% 2.1% 0.0%

※ 印付きの数値は Mythos 5 のスコアです。Fable 5 ではセーフガードのフォールバック(後述)が働くため、サイバー・バイオ・一部の推論系タスクにおける実際のスコアは Opus 4.8 に近づく点に注意してください。

Anthropicの計測方法:公開スコアは Mythos 5 / Fable 5 のうち高い方を掲載しており、両者の差はほとんどのテストで1〜3ポイント以内に収まっています。

注目ポイント①:コーディングが見出し ― SWE-bench Pro で 69.2% → 80.3%(Opus 4.8比+11ポイント)、次点モデルに11ポイント差をつけてのトップ。FrontierCode Diamond では相対差がさらに大きくなっています。

注目ポイント②:空間推論が約2.6倍 ― 14.5% → 38.6% と大きく伸びており、図形的・空間的な推論力の向上が確認できます。

注目ポイント③:法務推論がカテゴリトップに ― 「ぎりぎり合格」レベルからカテゴリ首位へと跳躍しています。

なお、TeslaのAI部門を率いていた Andrej Karpathy 氏は、リリース当日に「ベンチマーク上はあらゆる項目でSOTAだが、定性的にもメジャーバージョンアップに値するステップチェンジだ」とコメントしています。


API利用時の最重要ポイント:セーフガードのフォールバック

Mythosクラスの能力には実際の悪用リスクが伴うため、Fable 5 には サイバーセキュリティ・生物/化学・蒸留(distillation) をカバーする分類器(classifier)が組み込まれています。

これらの分類器がリクエストを検知すると、そのリクエストは自動的に Claude Opus 4.8 によって応答され、ユーザーにはその旨が通知されます。Anthropicによれば、このフォールバックが発生するのは全セッションの5%未満で、95%以上のセッションではフォールバックは一切起きません。

開発者が知っておくべきこと

  • 3つのカバー領域:サイバーセキュリティ / 生物・化学 / 蒸留。これらに該当するリクエストは Opus 4.8 にフォールバックされます。
  • APIでは Fallback API の設定が必要:Claudeアプリ(claude.ai)では自動的に処理されますが、API利用時は Anthropic の Fallback API を設定する必要があり、完全には自動化されていません。
  • フォールバックされたリクエストに Fable 価格は課金されない:Opus 4.8 として応答された分は Fable の料金が発生しません。
  • 30日間のデータ保持要件:Mythosクラスの全トラフィックに対して30日間のデータ保持が必須となります。これは安全監視のみに使われ、モデル学習には利用されません。
import anthropic
 
client = anthropic.Anthropic()
 
# 基本的な呼び出し。モデルIDに claude-fable-5 を指定するだけ
response = client.messages.create(
    model="claude-fable-5",
    max_tokens=4096,
    messages=[
        {"role": "user", "content": "このリポジトリ全体を解析して..."}
    ],
)
# サイバー/バイオ/蒸留に該当する内容は Opus 4.8 にフォールバックされる

セキュリティリサーチやバイオ・化学関連、あるいは分類器が蒸留と判定するような内容を扱うワークロードでは、一部のレスポンスが Opus 4.8 由来になることを想定しておく必要があります。


価格の詳細

Fable 5 はプレミアムモデルで、おおよそ Opus 4.8 の2倍の料金です。

トークン種別 Claude Fable 5 Claude Opus 4.8
入力 $10 / MTok $5 / MTok
出力 $50 / MTok $25 / MTok
5分キャッシュ書き込み $12.50 / MTok $6.25 / MTok
1時間キャッシュ書き込み $20 / MTok $10 / MTok
キャッシュヒット・リフレッシュ $1 / MTok $0.50 / MTok

実際のコストを左右するポイントは以下です。

  • プロンプトキャッシュ:キャッシュされた入力に90%割引が効くため、大きなシステムプロンプトやコンテキストを再利用する設計が有効です。
  • トークン効率:Anthropicおよび早期顧客は、Fable 5 がより少ないターン・少ないトークンでタスクを完了すると報告しています。単価が2倍でも、適切なタスクであれば総額は見かけほど開かないケースがあります。
  • US-only推論:データレジデンシー要件向けに、1.1倍の価格で米国限定の推論が利用可能です。

サブスクリプションプランでの提供(重要・段階的ロールアウト)

claude.ai のサブスクリプションプランでは、需要の読みにくさを考慮して段階的に提供されます。プランでは Fable 5 は 通常の2倍の利用量としてカウントされます。

  • 2026年6月9日〜6月22日:Pro / Max / Team / シートベースのEnterpriseプランで追加料金なしで利用可能
  • 2026年6月23日以降:上記プランから Fable 5 を一旦削除。以降の利用には使用クレジット(usage credits)が必要。容量に余裕があれば無料期間を延長する可能性あり
  • その後:十分な容量が確保でき次第、サブスクリプションの標準機能として Fable 5 を復活させる予定
    期間中の変更については、Anthropicが事前に告知するとしています。

安全性

今回のリリースは、能力の高さゆえに安全性の議論が中心に据えられています。

  • 保守的なセーフガード設定:安全かつ迅速にリリースするため、分類器は保守的(やや過敏)に調整されています。そのため良性のリクエストでも誤って検知(false positive)してしまうことがあります。Anthropicはリリース後にこの誤検知を減らしていくとしています。
  • ジェイルブレイク耐性:1,000時間超の外部バグバウンティでも汎用的なジェイルブレイクは発見されず、外部レッドチームによる長時間エージェントタスクでも(現時点では)汎用ジェイルブレイクは見つかっていません。
  • アラインメント評価:自動アラインメント評価において、Mythos 5(=Fable 5と同一モデル)の不整合な振る舞いの水準は低く、Opus 4.8 と同程度でした。
  • Claude Mythos 5:サイバー防御者・インフラ提供者の限定グループ向けに、サイバー領域のセーフガードを解除した Mythos 5 も同時に提供開始。Project Glasswing を通じて米国政府と連携して展開され、世界最強のサイバーセキュリティ能力を持つとされています。

まとめ

Claude Fable 5 は「Mythosクラスを初めて一般公開する」という、Anthropicにとって節目となるリリースです。エンジニアにとって重要なポイントは以下です。

  • **Opusの上位ティア(Mythosクラス)**の能力が、初めて一般のAPI・プランから利用可能に
  • コーディングが圧倒的:SWE-bench Pro 80.3%(Opus 4.8比+11pt)、5,000万行のコードベース移行を1日で完了した事例も
  • 長く複雑なタスクほど優位:大規模移行・数日規模のエージェント実行・深いリサーチに最適
  • ビジョンがSOTA、空間推論・法務推論も大幅向上
  • セーフガードのフォールバックに要注意:サイバー/バイオ/蒸留関連は Opus 4.8 にフォールバック(全体の5%未満)。API利用時は Fallback API の設定が必要
  • 価格は Opus 4.8 の約2倍($10 / $50)かつ 30日間のデータ保持が必須
  • サブスクは段階的提供:6/9〜6/22は無料、6/23以降は使用クレジットが必要
    短く・低レイテンシ・大量処理が求められるワークロードでは、半額の Opus 4.8 やより小さいモデルが依然として賢明な選択です。多くのチームが落ち着くパターンは「タスクの複雑さでルーティングする」― 難しく価値の高いジョブを Fable 5 に、それ以外を安価なモデルに振り分ける、という使い分けです。

大規模リファクタリング・長時間エージェント運用・深いリサーチを抱えているチームにとっては、検証する価値の高いモデルと言えます。


参考リンク

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?