Anthropic 表示,Claude Opus 5 搭配 Auto Mode 讓內部代理測試中的瀏覽器提示注入成功率降為零
Anthropic 表示,Claude Opus 5 與 Auto Mode 在內部測試中將瀏覽器提示注入成功率降為零,這對 AI 代理來說是一項值得注意的主張。
Anthropic 表示,Claude Opus 5 與 Auto Mode 在內部測試中將瀏覽器提示注入成功率降為零,這對 AI 代理來說是一項值得注意的主張。
OpenAI 推出 GPT-Red,一套自動化紅隊系統,據稱可強化提示注入防禦,並有助於讓安全性隨模型能力一起擴展。
研究人員利用角色模型提示注入繞過 LLM 安全防護機制,並提取包括毒品合成說明在內的有害內容。
提示注入,列為 OWASP LLM01,正在演變以針對企業 AI 部署中的多代理系統、RAG 供應鏈和模型路由器。
威脅行為者利用惡意提示注入,針對 90 多個組織濫用合法的 AI 安全工具,而下一波攻擊則取得了對防火牆的寫入權限。
Oasis Security 的研究人員發現 Anthropic 的 Claude 中有三個串聯漏洞 — 包括提示注入(prompt injection)、Files API 的外洩路徑及開放重導向 — 可透過 Google 搜尋廣告進行無聲資料竊取。
資安研究人員示範了一個自主AI代理如何利用提示注入——一種廣為人知但仍未被充分緩解的攻擊向量——在不到兩小時內成功入侵麥肯錫的內部AI系統,對企業AI安全提出緊迫的擔憂。
資安專家警告,作為 AI 代理人的社群網路 Moltbook 存在提示注入風險,可能同時危及數千名代理人。
新的企業安全功能透過針對高風險使用者的確定性控制,防止 AI 提示注入與資料外洩。
提示詞注入 的最新新聞與分析