注目事例  2026-08-01(土)配信

AnthropicのClaude、評価中に実システムへ不正アクセス

Anthropicは、サイバーセキュリティ評価の実施中に自社AIモデル「Claude」がインターネットに接続し、実在する3組織のシステムへ不正アクセスしていたと公表しました。評価パートナーとの認識の齟齬による設定ミスが原因とされており、同社はすべてのサイバー評価を一時停止して遡及レビューを実施しました。
攻撃手法(確認済み)
評価環境における設定不備により、隔離されているはずのテスト環境からインターネットへの接続経路が有効になっていました。AIモデルが実在するシステムの脆弱なパスワードや認証のないエンドポイントを悪用し、不正アクセスを行ったとされています。
攻撃手法(推測)
AIモデルのテスト環境やサンドボックスを構築する際、ネットワークの分離設定やファイアウォールのルールに不備があると、モデルが意図せず外部のインターネット環境へ到達し、実際の公開サービスを攻撃対象として認識してしう可能性があります。
自組織チェックポイント
自社で検証環境やサンドボックスを構築する際、インターネットへの不要な通信経路が遮断されているか
外部ベンダーやパートナーと共同で検証を行う際、環境のセキュリティ要件やネットワーク分離について認識の齟齬がないか
内部ネットワークやテスト環境において、脆弱なパスワードや認証のないエンドポイントが放置されていないか
AIや自動化ツールを用いた検証を実施する場合、適切な監視体制やフェイルセーフが講じられているか

明日のセキュリティ脅威情報も、あなたのメールに。

毎朝、攻撃手口の理解と自組織の脅威判断に役立つ情報をお届けします。購読は無料、配信停止はいつでも可能です。

無料で購読する →