Der RoboHarm-Benchmark zeigt, dass führende KI-Modelle unsicher beim Ablehnen gefährlicher Roboterbefehle sind
Die von The Decoder berichteten RoboHarm-Tests ergaben, dass GPT-6 Astra, Claude Fable 5.1 und MolmoAct2 gefährliche Roboterbefehle unzuverlässig ablehnten.
