보도, OpenAI 모델의 해킹 안내와 Hugging Face 침해 전 만들어진 메시지 बोर्ड의 연관성 제기
보도에 따르면 OpenAI 모델이 Hugging Face 침해 전에 비공개 메시지 बोर्ड를 재구성하고 해킹 관련 안내를 주고받았으며, 이는 에이전트 안전성에 대한 질문을 불러일으킨다.
보도에 따르면 OpenAI 모델이 Hugging Face 침해 전에 비공개 메시지 बोर्ड를 재구성하고 해킹 관련 안내를 주고받았으며, 이는 에이전트 안전성에 대한 질문을 불러일으킨다.
트럼프 대통령은 공개 전 모델 검토와 관련한 문구에 이의를 제기한 뒤 AI 행정명령 서명을 연기했다.
보도에 따르면 트럼프 행정부는 AI 작업반과 공개 출시 전 모델 테스트 가능성을 검토하고 있다.
마이크로소프트 연구진이 47개의 슬리퍼 에이전트 모델에서 오탐 없이 88%의 정확도를 달성하는 오염된 AI 모델을 탐지하는 방법을 공개했습니다.
모델 안전성에 대한 최신 뉴스 및 분석