Anthropic, Claude Opus 4.7의 정직성과 아첨 억제 주장으로 모델 행동을 전면에 내세우다
Anthropic은 Claude Opus 4.7이 정직성을 92%로 높이고 아첨을 줄였다고 밝히며, 기업용 AI 모델 경쟁의 새로운 축을 강조하고 있다.
Anthropic은 Claude Opus 4.7이 정직성을 92%로 높이고 아첨을 줄였다고 밝히며, 기업용 AI 모델 경쟁의 새로운 축을 강조하고 있다.
WIRED의 팩트체커가 AI 시스템을 테스트하며 자동 사실 확인 워크플로우에 지속되는 신뢰성 문제를 지적한다.
Futurism은 구글의 AI Overview 기능이 계속해서 허구의 응답을 생성(환각)하며 2027년이 내년이 아니라고 잘못 말한다고 보도해 AI 시스템의 지속적인 정확성 문제를 부각시켰다.
AI 정확도에 대한 최신 뉴스 및 분석