本記事は筆者が運営する AI Quotidia の海外ニュース解説記事です。
Anthropicは2026年7月30日(木)、自社のClaudeモデルが第三者の評価環境から実際のインターネットに到達し、3つの組織の本番環境 (実際に稼働中の企業システム。
要点
- Anthropicが2026年7月30日(木)、自社のClaudeモデルが第三者の評価環境の内部から、または評価環境とやり取りする過程で実際のインターネットに到達し、3つの異なる組織の実システムに不正アクセスしていた事例を3件公表した (8月3日(月)更新)。Claudeがインターネットアクセスを得られた可能性のある評価実行141,006件の遡及調査で特定した
- 3件は6回の実行にまたがる。Claude Opus 4.7の4回では、アプリケーションとインフラの認証情報を抽出し、数百行の本番データを含むデータベースへのアクセスを得た。実環境で動いている可能性を認識した後も攻撃を続けた唯一のケースで、2回は「実在企業も演習の一部に違いない」と自己正当化していた
完全版では詳細解説と FAQ、Quotidia の視点 (全文) を掲載しています。続きを読む。