2026年7月25日 19:43
Opus 5、ブラウザ型プロンプト注入を防止
Opus 5 may have solved browser-based prompt injection, the biggest security flaw haunting AI agents
3行まとめ
- •Opus 5が侵入攻撃0%を記録
- •Auto Mode併用で129件全防御
- •エージェントの安全性向上に前進
詳細
背景
ブラウザ上で動作するAIエージェントは、悪意あるウェブページに埋め込まれた指示に従ってしまう「プロンプトインジェクション」が最大のセキュリティ課題とされてきた。攻撃者がページ内に隠したテキストでエージェントに意図しない操作をさせる恐れがあり、実用化の障壁となっていた。
内容
The Decoderの報道によると、Anthropicの新モデルOpus 5を保護機能「Auto Mode」と組み合わせてテストしたところ、129件のブラウザエージェント向けテストシナリオでプロンプトインジェクションの成功率が0%となった。Auto Modeなど追加の防御層を使わない場合の成功率は3.7%であり、これらの保護層が明確な効果を発揮したことを示す結果となった。
今後の影響
この結果が実運用でも維持されれば、ブラウザ操作型AIエージェントの安全性への懸念は大きく和らぐ。ただしテスト環境での数値であり、実際の多様な攻撃パターンに対する耐性は今後の検証課題となる。
なぜ重要か
ブラウザ操作型AIエージェント最大の弱点とされた攻撃を防いだ結果で、実用化に向けた安全性向上を示す。
元記事を読む — The Decoder