🧠Research🔥🔥

Anthropic、Cyber Verification Program を刷新──Claude Opus 5.5 のセキュリティ特化型アクセスを提供

厳格な審査を経たセキュリティ専門チームに対し、Claude Opus 5.5 や Mythos 5.1 の過度なサイバーブロックを緩和し、ペネトレーションテストや脆弱性探索を加速させる。
リリース: 2026-10-06 · 読了 3 分

記事の要約

1. 核心(What)

  • Anthropic は Cyber Verification Program (CVP) を三階層のアクセス体系へ刷新し、Claude Opus 5.5 などのモデルにおけるサイバー防御フィルターの自動遮断を調整可能にした。
  • Project Glasswing の参加組織は 2026 年 4 月から 7 月の間に 129,000 件を超える検証済み脆弱性を発見し、オープンソーススキャン分と合わせると合計 134,500 件に到達した。
  • CyScenarioBench を用いた評価において、Red Team Access はセーフガード無しのベースライン(67.6%)に肉薄する完了率を示した一方で、Defense Access はトライアルの 92% を中断させた。
  • CVP は Claude Platform、Google Cloud の Vertex AI、Microsoft Foundry を通じて提供され、適用には CVP ポータルからの審査が必要となる。

2. 影響(Why)

  • セキュリティ評価の高度化: 従来の保守的なセーフガードでは正規の多段階セキュリティ作業まで中断されていたが、厳格な審査を経たチームに対して適切な権限を付与することで、実環境に近いペネトレーションテストを AI で実行可能になる。
  • 国内セキュリティ部門への適用: [金融・通信業のセキュリティ監査チーム] のような国内事業者では、自動ブロックによる検証の中断を回避しながら、最新モデルを活用した高度な脆弱性探索ワークフローを構築できるようになる。

3. 根拠・詳細(How)

  • CyScenarioBench による検証手法: マルチステージのサイバー攻撃オペレーションを計画・実行する能力を測るため、デフォルトセーフガード、Defense Access、Red Team Access、非セーフガードベースラインの 4 条件で 50 件のトライアルを実施し比較した。
  • マルチクラウドインフラによる提供: Claude Platform に加え、Google Cloud Vertex AI や Microsoft Foundry 経由で段階的なアクセス制御を実装し、秋以降には Amazon Bedrock での Enterprise Frontier Safeguards 対応を予定する。

4. 展望・課題(Next)

  • Enterprise Frontier Safeguards の展開: 2026 年秋に予定されている Enterprise Frontier Safeguards により、対象組織が自社制御のクラウドインフラ内でデータを保持したまま監視を受けられる仕組みへ移行する。