Claude in Chromeが一般提供開始、自律ブラウザー操作と多層的セーフティーが実現へ

一般提供の背景と自律アクションの実現

Anthropicは、Claude in Chromeを全有料プランで一般提供開始した。パイロット段階を経て、今回のリリースではClaudeがブラウザー内で自律的にアクションを実行できるようになり、逐一の承認が不要になった。ただし、各アクションはセーフティークラシファイアーによって検証され、安全性とリクエストとの整合性が確認される仕組みが維持されている。背景には、内部ダッシュボードやレガシーシステム、ベンダーポータルなど、Claudeと直接連携していない業務ツールへの対応ニーズがある。Claude in Chromeは既存のログイン情報を利用して、ページ閲覧、テキストの読み書き、リンククリック、フォーム入力などを行える。

プロンプトインジェクション対策の多層的アプローチ

ブラウザー上でAIエージェントが動作する際の最大のリスクはプロンプトインジェクションだ。悪意のある指示がウェブページやメール、フォームフィールドに隠され、ユーザーが意図しない動作を引き起こす可能性がある。Anthropicはこの対策として、複数の層からなる防御システムを構築した。まず、内部の自動攻撃者や外部のレッドチーマー、実世界のモニタリングから収集した攻撃ライブラリーを用いてモデルを訓練している。次に、ツール結果をスキャンするプローブを導入し、潜在的な攻撃を検出するとClaudeに警告を発する。さらに、自動承認前にアクションを検証するセーフティークラシファイアーを追加した。

評価結果が示すセーフティーの現状と今後の課題

評価の結果、Claude Opus 4.5では攻撃成功率が17.6パーセントだったのに対し、Claude Opus 5では3.8パーセントまで低下した。プローブとセーフティークラシファイアーを両方適用した場合、Claude Sonnet 5とClaude Opus 5では0パーセント、Fable 5でも0.3パーセントに抑えられた。成功した攻撃はすべて低重大性のシナリオに限定されていた。プロンプトインジェクションは進化し続ける脅威であるため、攻撃発見の自動化やクラシファイアーの強化への継続的な投資が不可欠だ。Claude in Chromeの一般提供は、AIエージェントが日常のウェブ業務を支援する時代の本格化を示している。一方で、他のChromiumブラウザーやモバイルへの展開は今後の課題として残されている。

Claude in Chrome is generally available