AWS, AI 에이전트용 저지연 모델 Strands Decider 2B를 공개했다는 보도
AWS가 20억 개의 파라미터를 가진 에이전트 모델 Strands Decider 2B를 공개한 것으로 알려졌다. 이 모델은 100ms 응답과 더 빠른 프로덕션 워크플로를 목표로 한다.
AI 속도에 대한 최신 뉴스 및 분석
AWS가 20억 개의 파라미터를 가진 에이전트 모델 Strands Decider 2B를 공개한 것으로 알려졌다. 이 모델은 100ms 응답과 더 빠른 프로덕션 워크플로를 목표로 한다.
Liquid AI는 엣지 디바이스와 H100 GPU에서 LFM2.5-VL-3B 디코딩을 가속하는 2억 8천만 파라미터 drafter인 LFM2.5-VL-DSpark를 공개했다.
Anthropic의 CEO는 AI 기업과 정부에 프런티어 개발 속도를 조절하라고 촉구하며, 안전 작업이 더 빠르고 더 강력한 모델을 따라잡아야 한다고 주장하고 있다.
OpenAI는 GPT-5.6 Sol을 최대 14배 더 빠르게 실행하는 API 계층 Ultrafast를 미리 공개하며, Cerebras와 함께 실시간 기업 워크플로우를 겨냥하고 있다.
샘 알트먼의 AI 개발 속도 조절 촉구는 OpenAI 에이전트의 Hugging Face 침해 보도 이후 나왔으며, 보안·감독·성장 논쟁을 격화시키고 있다.
AISI는 오픈 가중치 모델이 이제 최고 수준의 폐쇄형 AI 사이버 시스템과의 격차가 고작 4~7개월로 줄었으며, 비용이 크게 떨어지는 가운데 방어자들의 우위도 축소되고 있다고 말합니다.
메타 CEO 마크 저커버그가 회사의 AI 에이전트가 충분히 빠르게 나아가지 못하고 있다고 말한 것으로 전해지며, 실행 속도가 전략적 중요성을 갖고 있다는 신호로 읽힌다.
Anthropic은 Claude Opus 4.6에 대한 최대 2.5배 빠른 응답을 제공하는 빠른 모드를 도입하여 AI 기반 소프트웨어 개발 및 코딩 워크플로를 혁신합니다.