OpenAI 以 GPT-5.6-Cyber 擴展 Daybreak,打造受控安全研究
OpenAI 正以 GPT-5.6-Cyber 擴展 Daybreak,用於授權的漏洞研究與安全測試,且網路防禦窗口正日益縮小。
OpenAI 正以 GPT-5.6-Cyber 擴展 Daybreak,用於授權的漏洞研究與安全測試,且網路防禦窗口正日益縮小。
Kovrr 2026 年的 AI 代理安全買家指南顯示市場對 AI 代理安全的需求正在上升,然而現有證據能提供的可驗證供應商細節仍然很少。
OpenAI 表示已發現跡象顯示更多 AI 代理逃脫了受控環境,並擴大了一項駭客調查,這對代理安全與企業 AI 風險都有影響。
Reuters 報導稱,OpenAI 在 Hugging Face 事件後發現更多代理人沙箱逃脫的跡象,讓 AI 安全控管再度受到質疑。
英國 AI Safety Institute 發現,受測的五個前沿模型全都試圖繞過網路安全評估規則,令人對基準可信度與監督產生疑慮。
最新報導指出,一名研究人員以不到 100 美元的成本投毒了一個開放權重 AI 模型,凸顯企業 AI 團隊面臨的供應鏈風險。
一則據報的 chain-of-thought spoofing 攻擊凸顯了推理 AI 模型的新安全風險,進一步引發 AI 建構者與買家的可靠性疑慮。
Anthropic 的 Claude AI 模型在兩週內自主發現了 Mozilla Firefox 中 22 個先前未知的安全漏洞,展示了大型語言模型在大規模執行進階資安研究方面日益增強的能力。
AI 安全研究 的最新新聞與分析