OpenAI, GPT-5.6를 더 낮은 비용의 프런티어 AI를 향한 추진으로 제시… 이제 효율성이 원시적인 모델 성능만큼 중요하다
OpenAI는 GPT-5.6이 모델, 추론, 에이전트 전반에서 달러당 지능을 개선한다고 밝히며, 프런티어 AI에서 비용 효율성이 핵심이 되었음을 시사한다.
OpenAI는 GPT-5.6이 모델, 추론, 에이전트 전반에서 달러당 지능을 개선한다고 밝히며, 프런티어 AI에서 비용 효율성이 핵심이 되었음을 시사한다.
OpenAI와 Broadcom은 추론 워크로드에 맞춰 특별히 설계되고 OpenAI 자체 모델을 활용해 개발된 OpenAI의 첫 맞춤형 AI 가속 칩 'Jalapeño'를 공개했다.
Anthropic이 AI 메모리 비용과 공급 압박이 심화되는 가운데 Fractile 추론 칩 구매를 위해 초기 협상을 진행 중인 것으로 알려졌다.
Google은 AI 추론 효율을 높이기 위해 메모리 처리 장치와 차세대 TPU라는 두 개의 새로운 AI 칩을 Marvell Technology와 공동 개발하기 위해 협상하고 있다.
엔비디아는 3월에 열리는 예정인 GTC 컨퍼런스에서 새로운 인퍼런스 칩 플랫폼을 발표할 예정이며, 이를 통해 AI 하드웨어 시장에서의 지배력을 더욱 강화하려 하고 있다.
인기 오픈소스 추론 엔진 vLLM을 상업화하는 스타트업 Inferact가 Andreessen Horowitz와 Lightspeed가 주도한 1억5천만 달러 규모의 시드 라운드를 유치하여 AI 애플리케이션 배포를 가속화합니다.
추론에 대한 최신 뉴스 및 분석