RoboHarm 基準測試發現,領先的 AI 模型在拒絕危險機器人指令時不可靠
The Decoder 報導的 RoboHarm 測試發現,GPT-6 Astra、Claude Fable 5.1 和 MolmoAct2 在拒絕危險機器人指令方面不夠可靠。
AI危害 的最新新聞與分析
The Decoder 報導的 RoboHarm 測試發現,GPT-6 Astra、Claude Fable 5.1 和 MolmoAct2 在拒絕危險機器人指令方面不夠可靠。
根據AI Incident Database的分析,新研究顯示從2022到2024年,與AI相關的傷害報告年增率達50%,其中涉入深偽(deepfake)及惡意使用AI的事件明顯激增。