OpenAI, GPT-6 Astra Ultrafast를 NVIDIA Blackwell GPU에 제공
OpenAI의 GPT-6 Astra Ultrafast가 이제 NVIDIA Blackwell GPU에서 이용 가능해졌으며 더 빠른 에이전트 워크플로를 약속하지만, 핵심 성능 주장은 벤더가 보고한 내용에 기반한다.
AI GPU에 대한 최신 뉴스 및 분석
OpenAI의 GPT-6 Astra Ultrafast가 이제 NVIDIA Blackwell GPU에서 이용 가능해졌으며 더 빠른 에이전트 워크플로를 약속하지만, 핵심 성능 주장은 벤더가 보고한 내용에 기반한다.
AWS는 SageMaker AI에서 G5, G6, G6e, G7 전반에 걸쳐 30B MoE 모델을 벤치마킹하며, Blackwell이 추론 비용과 지연을 어떻게 개선할 수 있는지 보여준다.
NVIDIA의 새 추론 가이드는 GPU 용량과 TCO를 최대 수요만이 아니라 워크로드 동작, 모델 최적화, 유연한 배포에 연동한다.
NVIDIA는 Groq 3 LPX가 Vera Rubin과 함께 본격 생산에 들어갔으며, AI 에이전트와 멀티턴 워크로드를 위한 더 빠른 장문 컨텍스트 추론을 목표로 한다고 밝혔다.
NVIDIA의 ALCHEMI Toolkit은 AI 코딩 에이전트를 GPU 가속 재료 시뮬레이션과 연결하며, 벤치마크는 검증이 여전히 필수임을 보여준다.
Reflection AI가 Nebius와 10억 달러 규모의 컴퓨트 계약을 맺으면서, 오픈 모델 스타트업들이 희소한 AI 인프라를 확보하려 분주해지고 있음을 보여준다.
NVIDIA는 LLM 개발자들에게 GPU 친화적 추론을 위해 모델을 공동 설계하라고 촉구하며, 하드웨어를 고려한 아키텍처가 대규모에서 비용과 지연을 줄일 것이라고 보고 있다.
NVIDIA는 BioNeMo Agent Toolkit을 Anthropic의 Claude Science에 연결해 연구자들이 자연어로 GPU 가속 생물학 워크플로를 실행할 수 있도록 하려 한다.
NVIDIA는 BioNeMo Agent Toolkit을 Anthropic의 Claude Science와 통합해, AI 기반 연구를 위한 가속 생물학 워크플로를 더 쉽게 만드는 것을 목표로 하고 있다.
중국의 Nvidia 클라우드 파트너가 금지된 H100/H200 AI GPU가 탑재된 서버 300대를 9,200만 달러에 확보했으며, Super Micro 밀수 체포 이후 Sharetronic 주가는 급락하고 있다.