Anthropic, Claude에 대한 내부 연구가 분리 가능한 추론 계층을 시사한다고 밝혀, 언어 모델이 어떻게 생각하는지에 대한 논쟁이 다시 불붙다
Anthropic은 Claude에 분리 가능한 내부 추론 작업공간이 있다는 새로운 연구를 발견했다고 밝혔으며, 이는 AI 해석 가능성과 안전성 작업을 재편할 수 있는 주장이다.
Anthropic은 Claude에 분리 가능한 내부 추론 작업공간이 있다는 새로운 연구를 발견했다고 밝혔으며, 이는 AI 해석 가능성과 안전성 작업을 재편할 수 있는 주장이다.
CAS 소프트웨어 연구소가 AI 모델의 추론 과정을 더 잘 보이게 해 디버깅, 신뢰, 평가에 활용할 수 있도록 설계된 도구 Reasoning Lens를 출시했다.
Anthropic 연구진은 뉴런 분석과 심리학 실험을 통해 Claude AI의 내부 작동을 탐구하여 시스템의 마음을 이해하려 합니다.
AI 해석 가능성에 대한 최신 뉴스 및 분석