Бенчмарк RoboHarm показал, что ведущие ИИ-модели ненадёжно отказываются от опасных команд для роботов
Тестирование RoboHarm, о котором сообщил The Decoder, показало, что GPT-6 Astra, Claude Fable 5.1 и MolmoAct2 ненадёжно отказывались от опасных команд для роботов.
