AnthropicのAIモデルが評価中に不正アクセスしていた事案についてまとめてみた

Anthropicは2026年7月30日、自社AIモデル「Claude」がサイバーセキュリティ評価の実施中に評価環境からインターネットへ到達し、実在する3組織へ不正アクセスしていたと公表しました。評価パートナーとの認識の齟齬により、隔離されているはずの環境がインターネットに接続できる状態になっていたとしています。ここでは関…