문샷 AI 모델, 테스트 환경에서 탈출한 것으로 보도돼 에이전트 안전성 논란 커져
연구자들은 문샷 AI 모델이 테스트 환경에서 탈출했다고 말하며, 에이전트 자율성, 샌드박싱, AI 안전 통제에 대한 새로운 질문을 제기합니다.
연구자들은 문샷 AI 모델이 테스트 환경에서 탈출했다고 말하며, 에이전트 자율성, 샌드박싱, AI 안전 통제에 대한 새로운 질문을 제기합니다.
Wix가 소유한 바이브 코딩 플랫폼 Base44가 자체 AI 모델을 단계적으로 배포하기 시작했으며, 궁극적으로 프런티어 모델을 능가하고 경쟁력 있는 방어력을 구축하는 것을 목표로 하고 있다.
Anthropic은 Claude Sonnet 4.5를 공개하며, SWE-bench 코딩 및 OSWorld 컴퓨터 사용 벤치마크에서 최고 점수를 기록했다고 주장했고, 안전성과 정렬 측면에서도 큰 개선이 있었다고 밝혔습니다.
OpenAI는 최신 주력 AI 모델인 GPT-5.5를 공개했으며, 제한된 지시만으로도 코딩, 연구, 에이전트형 작업에서 뛰어난 성능을 보입니다.
OpenAI는 생물학 연구와 신약 개발 워크플로를 가속화하도록 설계된 제한적 접근 모델 GPT-Rosalind를 공개했다.
OpenAI는 검증된 사용자에게 GPT-5.4-Cyber를 공개하며, 고급 사이버 AI 도구에 대한 접근을 확대하는 동시에 새로운 안전장치와 접근 통제를 도입했다.
Anthropic의 강력한 Mythos 모델은 중요한 보안 격차를 부각합니다. AI는 조직이 이를 수정하는 것보다 훨씬 더 빠르게 소프트웨어 취약점을 식별할 수 있습니다.
Anthropic은 방어적 사이버 보안을 위한 강력한 AI 모델인 Claude Mythos Preview를 출시했으며, 해킹 위험으로 인해 사용이 제한됩니다. 파트너에는 Nvidia, Google, AWS가 포함됩니다.
알리바바가 세 번째 폐쇄형 AI 모델을 출시하며, 독자 기술을 보호하고 수익을 늘리기 위해 오픈소스에서 벗어나려는 전략적 전환을 시사했다.
데이터 유출로 Anthropic가 'Mythos'라는 코드명으로 강력한 새 AI 모델을 테스트 중인 사실이 드러났으며, 회사는 이 모델이 능력 면에서 상당한 도약을 의미한다고 확인했습니다. 보안 연구원들은 이 모델의 고급 추론 능력이 새로운 사이버보안 위험을 초래할 수 있다고 경고합니다.
Google은 Gemini 3 시리즈에서 가장 빠르고 비용 효율적인 모델인 Gemini 3.1 Flash-Lite를 출시했습니다. 가격은 입력 토큰 백만 개당 $0.25이며 이전 모델보다 2.5배 빠른 성능을 제공합니다.
구글은 최신 AI 모델인 Gemini 3.1 Pro를 공개했다. 이 모델은 ARC-AGI-2에서 추상적 추론 성능이 두 배로 향상되었으며, 19개의 주요 벤치마크 중 12개에서 경쟁 제품인 GPT-5.2와 Claude Opus 4.6을 능가했다.
Anthropic은 Claude Opus 4.6을 출시했습니다. 향상된 코딩 능력, 더 오래 지속되는 에이전트형 작업 수행 능력, 그리고 기업용 애플리케이션을 위한 혁신적인 에이전트 팀 기능을 특징으로 합니다.
구글이 최신이자 가장 지능적인 대형 언어 모델인 Gemini 3를 공식 출시했습니다. 새 모델은 향상된 추론 능력을 자랑하며 이미 구글 검색, Gemini 앱 및 기타 제품에 통합되어 있습니다.
AI 모델에 대한 최신 뉴스 및 분석