안전 우려가 모델에서 행동으로 옮겨가면서 AI 에이전트 행동 측정에 대한 새로운 관심이 주목받고 있다
The Guardian과 Cybersecurity Insiders의 보도는 기업들이 안전 리스크를 저울질하는 가운데, 배포 전에 AI 에이전트의 행동을 측정하려는 새로운 움직임을 부각한다.
The Guardian과 Cybersecurity Insiders의 보도는 기업들이 안전 리스크를 저울질하는 가운데, 배포 전에 AI 에이전트의 행동을 측정하려는 새로운 움직임을 부각한다.
보도에 따르면 5개 AI 랩이 8월 1일을 기한으로 공통 jailbreak 점수 체계를 지지하고 있으며, 이는 더 비교 가능한 AI 모델 안전 테스트를 향한 초기 단계다.
비영리 AI 조직인 METR의 차트는 대형 AI 시스템의 빠른 발전을 추적하면서 업계 전반의 집착 대상이 되었다.
AI 측정에 대한 최신 뉴스 및 분석