今回の成果の核心はAuto Modeに適用された二重防御体系だ。モデルが外部コンテンツを読み込んだ時点で入力をスキャンし、疑わしい指示が検出された場合にそのタスク自体をブロックする方法を組み合わせた。プロンプトインジェクションは、ウェブページや文書などの外部コンテンツに悪意のあるディレクティブを隠し、AIエージェントがユーザーの意図と違う行動をするように誘導する攻撃手法で、ブラウザを直接操作するエージェントが広がり、業界最大のセキュリティ脅威に選ばれてきた。 129のシナリオ全体のブロックは単一のベンチマーク結果であるが、商用モデルがこの領域で0%成功率を正式に達成したことは意味のあるマイルストーンと評価される。