RoboHarm 基準測試發現,領先的 AI 模型在拒絕危險機器人指令時不可靠
The Decoder 報導的 RoboHarm 測試發現,GPT-6 Astra、Claude Fable 5.1 和 MolmoAct2 在拒絕危險機器人指令方面不夠可靠。
高風險 AI 的最新新聞與分析
The Decoder 報導的 RoboHarm 測試發現,GPT-6 Astra、Claude Fable 5.1 和 MolmoAct2 在拒絕危險機器人指令方面不夠可靠。
歐盟官員表示,近期 OpenAI 與 Anthropic 事件顯示高風險 AI 系統需要監控,進一步提高 AI 合規與部署的重要性。
歐盟委員會未能在2月2日的截止日期前提交第6條指引,隨著針對高風險 AI 的規定將於8月開始執行,這加劇了合規的不確定性。