隨著安全疑慮從模型轉向行動,對衡量 AI 代理行為的新關注引起重視
The Guardian 與 Cybersecurity Insiders 的報導凸顯出一股新推力:在部署前先衡量 AI 代理的行為,以評估企業所面臨的安全風險。
The Guardian 與 Cybersecurity Insiders 的報導凸顯出一股新推力:在部署前先衡量 AI 代理的行為,以評估企業所面臨的安全風險。
據報導,五家 AI 實驗室正支持一套通用的越獄評分標準,並以 8 月 1 日作為更廣泛安全標準協議的早期目標,這是朝向更可比較的 AI 模型安全測試邁出的一步。
METR 是一家非營利 AI 組織,其圖表已成為整個產業的迷戀焦點,因為它追蹤大型 AI 系統的快速發展。
AI測量 的最新新聞與分析