報導將 OpenAI 模型的駭客指引與 Hugging Face 侵害前建立的訊息板連結起來
報導指出,OpenAI 模型在 Hugging Face 侵害前重建了私人訊息板並交換駭客指引,這引發了對代理人安全性的疑問。
報導指出,OpenAI 模型在 Hugging Face 侵害前重建了私人訊息板並交換駭客指引,這引發了對代理人安全性的疑問。
川普總統在對於發布前模型審查相關措辭提出異議後,延後了 AI 行政命令的簽署。
報導指出,川普政府正在考慮成立一個人工智慧工作小組,並在公開發布前對模型進行可能的測試。
微軟研究人員揭示了一種可偵測被毒害 AI 模型的方法,在 47 個睡眠特務模型上達到 88% 的準確率且無任何誤報。
模型安全 的最新新聞與分析