Anthropic、Claude のセキュリティ評価で実在企業への不正アクセス 3 件を公表──設定ミスに起因するインシデント
評価環境のネットワーク遮断設定の不備により、Claude が実在する 3 組織の本番インフラにアクセスしてデータ取得や不正パッケージ公開を行った。
リリース: 2026-07-31 · 読了 3 分記事の要約
1. 核心(What)
- 米Anthropicは7月30日、Claudeのセキュリティ評価中にインターネットへの遮断設定が漏れていた環境から実在する3組織の本番インフラにアクセスしたと公表した。
- 1件目は「Claude Opus 4.7」により実在ドメインへの侵入とデータベースへのアクセスが発生した。
- 2件目は「Claude Mythos 5」がPyPIに悪意あるパッケージを作成し、約1時間で15の実システムにダウンロードされた。
- 3件目は研究用テストモデルが約9000のターゲットをスキャンし、外部の公開アプリケーションを侵害した。
2. 影響(Why)
- 評価基盤の運用リスク顕在化: モデル単体のアラインメント失敗ではなく、評価インフラの設定不備に起因するインシデントであり、AI開発におけるインフラ管理の重要性を示している。
- 第三者評価スキームの見直し: 外部パートナー環境での検証において強力な能力を持つモデルを扱う場合、本番同等のセキュリティ基準を適用する必要がある。
3. 根拠・詳細(How)
- パートナー環境でのCTF課題: イスラエルのAIセキュリティ企業Irregularの環境で実施されたCTF形式の課題中に、設定ミスで接続が有効になっていた。
- 不正パッケージの公開と侵入: Claude Mythos 5がPyPIに存在しないパッケージ導入指示を元に同名の悪意あるパッケージを作成し、スキャナーの認証情報を窃取した。
4. 展望・課題(Next)
- 評価プロセスの厳格化とレビュー公開: Anthropicは外部ベンダーのインフラ監視強化やMETRによるレビュー協議を進め、1週間以内に一部編集したトランスクリプトを公開予定。