Anthropic、Webブラウザ自動操作ツール Claude in Chrome を公開──プロンプトインジェクション対策を強化
Anthropic はブラウザ拡張機能 Claude in Chrome を全プラン向けに一般提供し、実運用の課題となるプロンプトインジェクションに対して 3 段階の防御機構を導入した。
リリース: 2026-09-24 · 読了 3 分記事の要約
1. 核心(What)
- Anthropicは2026年8月26日、Google Chrome拡張機能 Claude in Chrome の一般提供を開始した。
- ユーザーの事前承認を経た上で、AIエージェントがテキストの読み込みやリンクのクリック、フォームへの入力などのブラウザ操作を自律的に実行する。
- プロンプトインジェクション対策として、レッドチームの検証に基づくデータ追加、モデルによる事後プルーブ、実行前のユーザークリック承認という3段階の防御機構を実装している。
- Claude Opus 4.8 以降のモデルと防衛機構を組み合わせることで、悪意あるコンテンツからの攻撃成功率をほぼ0%に抑制することに成功した。
2. 影響(Why)
- 実用化の最大障壁であるセキュリティをクリア: Webコンテンツ経由の悪意ある指示混入リスクを多段防御で抑え込むことで、エンタープライズでのエージェント導入判断が安全に進められる。
- 国内エンタープライズの運用統制に合致: Enterprise プラン向けのドメイン制限機能により、情報システム部門が認可したサイトのみでエージェントを稼働させる厳格な統制が可能になる。
3. 根拠・詳細(How)
- 3段階のプロンプトインジェクション防御機構: 第1段階の学習時フィルタリング、第2段階のClaude Opus 4.5等による事後プルーブでの攻撃検出、第3段階の auto モードによる実行前承認の3層構造で不正な外部入力を遮断する。
- Enterprise版のポリシー管理と制限事項: Chrome Web Storeから導入可能で、Enterpriseプランでは管理者のグループポリシーによりアクセスドメインを制限。なお、デスクトップアプリやChromium系以外のブラウザでは現時点で動作しない。
4. 展望・課題(Next)
- 攻撃手法の変化に対する継続的追従: 巧妙化するプロンプトインジェクションに対し、モデルリリース毎の攻撃試行データの追加とレッドチームによる検証を継続する方針。