Anthropic、Claude Opus 5 と Auto Mode でブラウザのプロンプトインジェクション成功率を社内エージェントテストでゼロにしたと発表
Anthropicは、Claude Opus 5 と Auto Mode が社内テストでブラウザのプロンプトインジェクション成功率をゼロにしたと述べており、AIエージェントにとって注目すべき主張です。
Anthropicは、Claude Opus 5 と Auto Mode が社内テストでブラウザのプロンプトインジェクション成功率をゼロにしたと述べており、AIエージェントにとって注目すべき主張です。
OpenAIは、プロンプトインジェクション対策を強化し、モデル能力の向上に合わせて安全性をスケールさせる助けになる可能性がある自動レッドチーミングシステムGPT-Redを導入したと発表した。
研究者らは役割モデルへのプロンプトインジェクションを悪用し、LLMの安全対策を回避して、薬物合成の手順を含む有害な内容を抽出した。
OWASP LLM01に分類されるプロンプトインジェクションは、企業のAI導入においてマルチエージェントシステム、RAGサプライチェーン、モデルルーターを標的とする方向へ進化している。
脅威アクターは、悪意のあるプロンプトインジェクションを用いて90以上の組織で正規のAIセキュリティツールを悪用し、次の波ではファイアウォールへの書き込み権限を得た。
Oasis Securityの研究者はAnthropicのClaudeにおいて3つの連鎖する脆弱性を発見しました — プロンプトインジェクション、Files APIによるデータ抜き取り経路、オープンリダイレクトを含む — これによりGoogle検索の広告を通じて静かにデータを盗み出せるようになります。
セキュリティ研究者は、自律型AIエージェントがプロンプト注入という、よく知られているが依然として広く対策されていない攻撃手法を悪用して、マッキンゼーの社内AIシステムを2時間未満で成功裏に侵害したことを実証し、企業向けAIのセキュリティに関する緊急の懸念を引き起こしました。
サイバーセキュリティの専門家は、AIエージェント向けのソーシャルネットワークであるMoltbookがプロンプトインジェクションのリスクを抱えており、数千のエージェントが同時に侵害される可能性があると警告しています。
新しい企業向けセキュリティ機能により、AIのプロンプト注入やデータの不正持ち出しを、高リスクユーザー向けの決定論的な制御で防ぎます。
プロンプトインジェクションに関する最新ニュースと分析