Nvidia의 Nemotron 3.5 Lightning, 빠르고 효율적인 AI 에이전트를 겨냥하다
Nvidia의 Nemotron 3.5 Lightning은 희소 활성화와 양자화를 사용해 빠른 오픈웨이트 추론을 제공하며, 최고 점수보다 대량의 AI 에이전트를 목표로 한다.
Nvidia의 Nemotron 3.5 Lightning은 희소 활성화와 양자화를 사용해 빠른 오픈웨이트 추론을 제공하며, 최고 점수보다 대량의 AI 에이전트를 목표로 한다.
옥스퍼드가 AI 정보작전 위험을 위한 라이브 벤치마크를 공개하면서, 모델 제작자와 구매자에게 시간이 지나도 추적할 수 있는 새로운 안전 신호를 제공했다.
OpenAI는 두 개의 API 설정으로 ARC-AGI-3에서 GPT-5.6 점수가 세 배가 됐다고 밝히며, 추론 구성이 모델 성능을 어떻게 바꿀 수 있는지 강조했다.
Anthropic의 Claude Opus 5가 ARC-AGI-3에서 새로운 최고 점수를 기록하며, 실제 추론 능력 향상인지 벤치마크 대응인지에 대한 질문이 다시 불거졌다.
독일의 오픈 모델 Soofi S는 완전 오픈 영어·독일어 벤치마크에서 최고 성과를 주장하는 한편, 개발자들은 테스트 데이터 유출을 공개하고 수정했다.
NVIDIA는 LangChain이 튜닝한 Nemotron 3 Ultra가 오픈 모델 에이전트 벤치마크에서 최고 수준의 결과를 달성해 더 낮은 비용의 기업 AI 스택을 부각했다고 말한다.
Yellow.com의 보고서에 따르면 Meta는 내부 ‘Watermelon’ AI 모델이 GPT-5.5에 도달했다고 직원들에게 전했다. 이는 최전선 모델 경쟁이 한층 치열해지고 있음을 시사한다.
Mark Zuckerberg는 Meta의 AI 에이전트 개선 속도가 자신이 기대했던 것보다 더디다고 직원들에게 말했다. 이는 대규모 플랫폼 베팅에 대한 주목할 만한 현실 점검이다.
개발자와 고급 사용자들은 Anthropic이 Claude Opus 4.6과 Claude Code의 성능을 저하시켰다고 비난하고 있으며, 투명성을 둘러싼 반발을 불러일으키고 있다.
AI 성능에 대한 최신 뉴스 및 분석