Home
AIリーダーシップ
AI NEWS
AIツール
AI Trends
AI Native Lab
購読

Anthropic 'Claude Opus 5'、プロンプトインジェクション129シナリオすべてをブロック

팀제이커브
カテゴリー
Empty
Anthropicが7月24日に発売した最新のフラッグシップモデル「Claude Opus 5」がAIエージェントセキュリティの新しい基準を立てた。 AIエージェント専門メディアAI Agent Storeによると、Claude Opus 5は、Auto Mode環境で行われた129のブラウザベースのプロンプトインジェクションテストシナリオをすべてブロックし、攻撃成功率0%を記録した。知能評価スコアは61点で、前世代モデルと同級性能を半分のコストで提供するという点も注目されている。
今回の成果の核心はAuto Modeに適用された二重防御体系だ。モデルが外部コンテンツを読み込んだ時点で入力をスキャンし、疑わしい指示が検出された場合にそのタスク自体をブロックする方法を組み合わせた。プロンプトインジェクションは、ウェブページや文書などの外部コンテンツに悪意のあるディレクティブを隠し、AIエージェントがユーザーの意図と違う行動をするように誘導する攻撃手法で、ブラウザを直接操作するエージェントが広がり、業界最大のセキュリティ脅威に選ばれてきた。 129のシナリオ全体のブロックは単一のベンチマーク結果であるが、商用モデルがこの領域で0%成功率を正式に達成したことは意味のあるマイルストーンと評価される。
性能に対するコスト効率も目立つ。 Claude Opus 5は、インテリジェンススコア61点を記録しながらも運用コストを以前のモデルの約半分に下げ、特にコーディングと分析作業で強みを見せるという評価だ。高性能モデルのコストバリアが低くなり、これまでコスト問題で上位モデルの導入を遅らせた企業のエージェント転換が加速できるという見通しが出ている。
今回の発表はエージェントインフラ全般が成熟する流れの中で出た。同じ主なオープンソース陣営では、ローカル推論エンジンFlama.cppがMCPスタイルのツールコールプロトコルサポートを追加し、NVIDIAはオブジェクト指向エージェントフレームワーク「NOOA」を公開した。クラウドとローカルを選ばず、エージェントが外部ツールを直接扱う環境が標準化されるだけに、セキュリティがエージェント信頼性の最優先課題として浮上しているという防証だ。
専門家たちは今回の結果をきっかけに企業セキュリティチームの実務対応も変わらなければならないと助言する。 AI Agent Storeは、独自のブラウザエージェントを運営する組織であれば、Auto Modeと同様の入力スキャン、タスクブロックメカニズムを実装し、ブロックされたイベントを週単位で検討してポリシーを継続的に調整することを推奨した。エージェントが電子メール、決済、社内システムまで扱う時代に「攻撃成功率0%」が一回限りのマーケティング数値にとどまるか、業界標準の要求事項として位置づけられる今後のサードパーティモデルの対応と独立検証結果にかかっている。
AI Native 백과사전
「AI Native百科事典」を購読する
サイトを購読すると、新しい投稿などの最新のアップデートを通知やメールで最初に受け取ることができます。
Slashpageに参加して「AI Native百科事典」を購読してください!
購読
👍