RoboHarmベンチマークで、主要AIモデルは危険なロボット指示の拒否が不安定と判明
The Decoderが報じたRoboHarmのテストでは、GPT-6 Astra、Claude Fable 5.1、MolmoAct2が危険なロボット指示の拒否において信頼性に欠けることが分かった。
高リスクAIに関する最新ニュースと分析
The Decoderが報じたRoboHarmのテストでは、GPT-6 Astra、Claude Fable 5.1、MolmoAct2が危険なロボット指示の拒否において信頼性に欠けることが分かった。
EU当局は、最近のOpenAIとAnthropicの事案が高リスクAIシステムの監視の必要性を示しているとし、AIコンプライアンスと導入の重要性が高まっていると述べています。
EU委員会は2月2日の期限までに第6条のガイダンスを提出できず、8月に施行が迫る高リスクAI規則に関するコンプライアンスの不確実性を高めています。