“But marinade”와 유출된 비밀번호가 AI 추론 API 내부의 위험을 드러낸다
연구자들은 API 결함으로 공개 세션에서 숨겨진 AI 추론과 비밀 정보가 노출됐다고 말하며, AI 제작자와 기업에 보안·프라이버시 위험을 높이고 있다고 밝혔다.
연구자들은 API 결함으로 공개 세션에서 숨겨진 AI 추론과 비밀 정보가 노출됐다고 말하며, AI 제작자와 기업에 보안·프라이버시 위험을 높이고 있다고 밝혔다.
Anthropic의 Claude Opus 5가 ARC-AGI-3에서 새로운 최고 점수를 기록하며, 실제 추론 능력 향상인지 벤치마크 대응인지에 대한 질문이 다시 불거졌다.
NVIDIA는 5,000명 이상이 참가한 Kaggle 챌린지가 더 큰 모델보다 검증된 트레이스와 워크플로 설계가 AI 추론을 더 크게 개선한다는 점을 보여줬다고 말한다.
Anthropic은 새로운 Claude 해석가능성 연구가 모델 추론의 일부를 추적할 수 있다고 밝히며, AI 안전성, 디버깅, 기업 신뢰에 있어 주목할 만한 진전이라고 말합니다.
AgenticSTS 연구진은 구조화된 메모리가 AI 에이전트가 Slay the Spire 2를 이기면서도 토큰 사용을 줄이는 데 도움이 됐다고 말하며, 컨텍스트 부패를 넘어설 실용적 경로를 보여줬다.
Anthropic은 Claude에 분리 가능한 내부 추론 작업공간이 있다는 새로운 연구를 발견했다고 밝혔으며, 이는 AI 해석 가능성과 안전성 작업을 재편할 수 있는 주장이다.
CAS 소프트웨어 연구소가 AI 모델의 추론 과정을 더 잘 보이게 해 디버깅, 신뢰, 평가에 활용할 수 있도록 설계된 도구 Reasoning Lens를 출시했다.
구글이 Gemini 3 Deep Think의 대규모 업그레이드를 공개하여 '인류의 마지막 시험'에서 48.4%를 달성하고 국제 올림피아드 문제에서 금메달급 성과를 냈습니다.
AI 추론에 대한 최신 뉴스 및 분석