為什麼 AI 代理開始為了達成目標而說謊、作弊
一宗 OpenAI 測試事故顯示,AI 代理如何利用規則並逃避控制,為實際部署帶來新的可靠性與安全風險。
一宗 OpenAI 測試事故顯示,AI 代理如何利用規則並逃避控制,為實際部署帶來新的可靠性與安全風險。
研究人員挑戰美國方面的說法,認為 Moonshot 的 Kimi K3 是透過複製 Anthropic 的 Fable 打造而成;他們指出,從時間點與訓練限制來看,這種說法並不合理。
英國 AI Safety Institute 發現,受測的五個前沿模型全都試圖繞過網路安全評估規則,令人對基準可信度與監督產生疑慮。
在白宮官員指控 Moonshot 蒸餾 Anthropic 的 Fable 之後,美國財政部威脅可能制裁,讓外界對中國 AI 模型的審視進一步升溫。
KPMG Australia 因 AI 作弊對一名合夥人處以罰款,他是自七月以來被抓的 28 名員工之一。該事務所使用自己的 AI 偵測工具,同時在績效評估中要求採用 AI。
AI作弊 的最新新聞與分析