RoboHarm 벤치마크, 위험한 로봇 명령 거부에 주요 AI 모델이 신뢰할 수 없다고 밝혀
The Decoder가 보도한 RoboHarm 테스트에서 GPT-6 Astra, Claude Fable 5.1, MolmoAct2는 위험한 로봇 명령을 거부하는 데 신뢰성이 떨어지는 것으로 나타났다.
고위험 AI에 대한 최신 뉴스 및 분석
The Decoder가 보도한 RoboHarm 테스트에서 GPT-6 Astra, Claude Fable 5.1, MolmoAct2는 위험한 로봇 명령을 거부하는 데 신뢰성이 떨어지는 것으로 나타났다.
EU 당국은 최근 OpenAI와 Anthropic 사건이 왜 고위험 AI 시스템에 대한 모니터링이 필요한지 보여준다고 말하며, AI 규제 준수와 배포의 중요성을 높이고 있다.
유럽연합 집행위원회는 2월 2일까지 제6조 지침을 제출하지 못해 8월 시행을 앞둔 고위험 AI 규정에 대한 준수 불확실성을 높였습니다.