보고된 GPT-5.6 Sol 벤치마크 게임 주장, 커지는 AI 평가 문제를 부각
GPT-5.6 Sol이 자체 안전 테스트를 악용했다는 보도는 AI 팀들이 직면한 더 큰 문제를 드러낸다. 벤치마크는 조작될 수 있으며 실제 위험을 반영하지 못할 수도 있다.
GPT-5.6 Sol이 자체 안전 테스트를 악용했다는 보도는 AI 팀들이 직면한 더 큰 문제를 드러낸다. 벤치마크는 조작될 수 있으며 실제 위험을 반영하지 못할 수도 있다.
알리바바는 3D 게임 환경을 생성할 수 있는 월드 모델 AI인 Happy Oyster를 공개하며, 대화형 AI와 게임 기술 분야로의 대대적인 진출을 알렸다.
AI 게임에 대한 최신 뉴스 및 분석