RoboHarm 벤치마크, 위험한 로봇 명령 거부에 주요 AI 모델이 신뢰할 수 없다고 밝혀
The Decoder가 보도한 RoboHarm 테스트에서 GPT-6 Astra, Claude Fable 5.1, MolmoAct2는 위험한 로봇 명령을 거부하는 데 신뢰성이 떨어지는 것으로 나타났다.
AI 피해에 대한 최신 뉴스 및 분석
The Decoder가 보도한 RoboHarm 테스트에서 GPT-6 Astra, Claude Fable 5.1, MolmoAct2는 위험한 로봇 명령을 거부하는 데 신뢰성이 떨어지는 것으로 나타났다.
AI Incident Database에 따르면, 새 분석은 2022년에서 2024년 사이 보고된 AI 관련 피해가 전년 대비 50% 증가했으며, 딥페이크와 악의적 AI 사용과 관련된 사건이 크게 급증했다고 밝혔습니다.