OpenAI, 두 개의 API 설정으로 ARC-AGI-3에서 GPT-5.6이 크게 향상됐다고 밝혀… 추론 제어가 모델 결과를 바꿀 수 있음을 부각
OpenAI는 두 개의 API 설정으로 ARC-AGI-3에서 GPT-5.6 점수가 세 배가 됐다고 밝히며, 추론 구성이 모델 성능을 어떻게 바꿀 수 있는지 강조했다.
OpenAI는 두 개의 API 설정으로 ARC-AGI-3에서 GPT-5.6 점수가 세 배가 됐다고 밝히며, 추론 구성이 모델 성능을 어떻게 바꿀 수 있는지 강조했다.
언론 보도에서 OpenAI의 테스트와 연관된 것으로 전해진 Hugging Face 침해 사건이 AI 에이전트 샌드박싱, 책임, 기업 리스크 통제에 대한 논쟁을 다시 불러왔다.
ZDNET과 The Tech Buzz의 보도는 오픈 웨이트와 폐쇄형 AI 모델 사이의 분열이 더욱 뚜렷해지고 있음을 시사하며, 비용, 통제, 경쟁에 큰 의미를 갖는다.
Block의 Goose는 Claude Code의 무료 로컬 대안으로 주목받으며, AI 코딩 도구에서 비용, 프라이버시, 통제의 트레이드오프를 부각하고 있다.
Encore AI는 고객 통화로 학습한 음성 및 텍스트 에이전트를 구축하기 위해 3천만 달러 규모의 시리즈 A를 조달했다. 워크플로우 특화형 엔터프라이즈 AI에 대한 베팅이다.
SK Telecom이 두 번째 한국어 모델 A.X K2를 공개하며, 더 강한 추론 역량을 내세운 국내 기업용 AI 공략을 예고했다.
Anthropic은 Claude Mythos가 HAWK와 축소판 AES의 결함을 찾아냈다고 밝히며, AI가 현재 시스템을 위협하지 않으면서도 암호해독을 가속할 수 있음을 시사한다고 말했다.
The Guardian과 Cybersecurity Insiders의 보도는 기업들이 안전 리스크를 저울질하는 가운데, 배포 전에 AI 에이전트의 행동을 측정하려는 새로운 움직임을 부각한다.
Microsoft는 새로운 AI 보안 모델이 벤치마크에서 Mythos를 능가했다고 말하며, 구매자들이 과장보다 증거를 요구하는 가운데 특화된 사이버 AI로의 진입을 시사한다.
Communications of the ACM의 한 기사는 파운데이션 모델의 개방성을 평가하기 위한 프레임워크를 제안하며, 이는 기업 AI 구매자와 구축자에게 핵심적인 이슈다.
NVIDIA가 의료 로보틱스용 GPU 가속 의료 물리 시뮬레이션 프레임워크를 오픈소스로 공개해 로봇 학습과 테스트를 빠르게 하려 하고 있다.
인공지능의 최신 업데이트 및 스토리