2026年7月24日 02:13
Cisco調査:AIが多段階攻撃で88%突破
Multi-turn attacks broke AI models 88% of the time — single-turn testing missed it, Cisco AI security lead warns at VB Transform 2026
3行まとめ
- •Ciscoが主要AIに多段階攻撃実験実施
- •適応型攻撃で88.3%突破と判明
- •単発型テストの限界露呈
詳細
背景
Ciscoで脅威インテリジェンスとセキュリティ研究を統括するエイミー・チャン氏が、VB Transform 2026のエージェントセキュリティパネルで新たな調査結果を発表した。同社は15の主要AIモデルを対象に、会話のやり取りを重ねながら手口を変化させる合計6,986件のマルチターン攻撃を実施した。
内容
単発の指示ではなく複数回の会話を通じて攻撃を適応させた場合、OpenAI・Anthropic・Google・xAIを含む全モデルが平均88.3%という高い確率で突破されることが判明した。従来主流だった、1回のやり取りだけで安全性を検証するシングルターン型のレッドチーミングでは、こうした脆弱性を見逃してきた可能性が高いという。VentureBeatが2026年6月に企業107社を対象に実施した調査でも、半数以上の企業がAIセキュリティ体制に不安を抱えていることが分かった。
今後の影響
この結果は、企業がAIエージェントを業務に組み込む際、単発のプロンプト検証だけでは不十分であり、会話全体を通じた継続的な脆弱性評価の仕組みが必要であることを示している。既存のレッドチーミング手法や社内のAIセキュリティ基準を見直す動きが今後広がりそうだ。
なぜ重要か
OpenAIやAnthropicなど主要AIモデル全てが多段階攻撃で88%突破され、単発診断中心の対策では不十分と判明した。
元記事を読む — VentureBeat AI