Claudeがブラウザを自律操作する「Claude in Chrome」一般提供開始 懸念されるプロンプトインジェクションをどう防ぐのか?

Anthropicは2026年8月26日(米国時間)、Webブラウザ「Google Chrome」の拡張機能として、AIがブラウザを自律操作する「Claude in Chrome」の一般提供を開始したと発表しました。この機能は、Claudeのすべての有料プランを契約しているユーザーであれば、Chrome ウェブストアから導入してすぐに利用することができます。

AIがユーザーに代わってWebブラウザを操作し、情報の収集やフォームへの入力などを自律的に行う「AIエージェント」の技術は、業務効率化の切り札として期待されています。しかし、その一方で、悪意のあるWebサイトやデータにアクセスした際、AIが予期せぬ指示(プロンプトインジェクション)を受けて暴走するリスクが指摘されてきました。

本記事では、新たに提供された「Claude in Chrome」が、このプロンプトインジェクションという重大なセキュリティ脅威に対してどのような防御策を講じているのか、その仕組みと検証データ、そして企業向けの管理機能について詳しく解説します。

実行直前の操作を検証する「安全性分類器」の仕組み

自律操作型AIにおける最大の懸念は、AIが閲覧したWebページ上に仕込まれた悪意ある命令を「ユーザーからの指示」と誤認し、勝手に外部へデータを送信したり、不要な操作を実行したりすることです。

「Claude in Chrome」では、こうしたリスクを排除するために「安全性分類器」と呼ばれるシステムを導入しています。安全性分類器は、AIが新しいWebサイトへ移動したり、ページ内のフォームにテキストを入力したりする「実行直前の操作」をその都度確認します。

そして、実行前に安全性分類器が各操作を検証し、安全かどうかと、ユーザーの依頼内容に合致しているかどうかを確認します。安全性分類器が、新しいWebサイトへの移動やページへのテキスト入力といった実行直前の操作を確認し、ユーザーが最初に依頼した内容と照合して合致しない操作をブロックします。これにより、AIが外部の悪意ある指示に誘導されるのを防ぐ仕組みとなっています。

プロンプトインジェクションを防ぐセキュリティシールドのイメージ

実行結果を走査する「プローブ」との併用

安全性分類器による事前検証に加え、システムには「プローブ」と呼ばれる防御機構も組み込まれています。プローブは実行結果を走査し、プロンプトインジェクションの疑いがある内容を検出して警告を渡す役割を担います。

この「安全性分類器」と「プローブ」という2つのアプローチを併用することで、防御の精度は極めて高いレベルに達していることが確認されています。

Anthropicの検証データによると、プローブと安全性分類器を併用した場合、「Claude Opus 4.8」以降のモデルでは攻撃はほぼ成功しませんでした(Claude Sonnet 5、Claude Opus 5、Claude Mythos 5に対して成功した攻撃はなく、Claude Fable 5に対しては0.3%)。具体的なモデル別の結果は以下の通りです。

  • Claude Sonnet 5:成功した攻撃はなし(0%)
  • Claude Opus 5:成功した攻撃はなし(0%)
  • Claude Mythos 5:成功した攻撃はなし(0%)
  • Claude Fable 5:成功した攻撃は0.3%

このように、最新世代のモデル群においては、攻撃の成功率を極めてゼロに近い水準、あるいは完全にゼロに抑え込むことに成功しています。自律操作AIの社会実装において、この高い安全性の実証は極めて重要な意味を持ちます。

企業導入を後押しする「Enterpriseプラン」の管理機能

個人利用だけでなく、企業組織における業務自動化での活用を見据え、「Claude in Chrome」には高度なガバナンス機能も用意されています。

「Enterpriseプラン」を契約している組織では、管理者が組織設定を通じてこの拡張機能の利用をコントロールすることができます。具体的には、Enterpriseプランでは管理者が組織設定で利用を管理し、承認済みのドメインに限定することができます。

これにより、社内のイントラネットや信頼できる特定のSaaSツール内のみでAIエージェントを動作させ、未承認の外部サイトや危険なドメインへのアクセスを技術的に制限することができます。情報漏洩や不正アクセスのリスクを最小限に抑えたい企業にとって、このドメイン制限機能は必須のセキュリティ対策となるでしょう。

まとめ

「Claude in Chrome」の一般提供開始は、AIが人間の代わりにブラウザを操作する未来を大きく手繰り寄せました。そして、その実用化を支えるのは、プロンプトインジェクションを徹底的に防ぐ「安全性分類器」と「プローブ」の多層防御システムです。

高い安全性が実証された最新モデルの活用と、Enterpriseプランにおけるドメイン制限などの管理機能により、個人から大企業まで、安全かつ効率的にAIエージェントの恩恵を享受できる環境が整いつつあります。

情報元

コメント