Mistral Large 4, 1조 매개변수 멀티모달 모델로 프런티어 경쟁자 겨냥
Mistral AI가 오픈 및 폐쇄형 경쟁자를 겨냥한 1조 매개변수 멀티모달 모델 Mistral Large 4를 공개했다. 다만 안전성 테스트를 위해 가중치 공개는 늦춰진다.
멀티모달 AI에 대한 최신 뉴스 및 분석
Mistral AI가 오픈 및 폐쇄형 경쟁자를 겨냥한 1조 매개변수 멀티모달 모델 Mistral Large 4를 공개했다. 다만 안전성 테스트를 위해 가중치 공개는 늦춰진다.
Meta가 다양한 하드웨어에서 로컬 에이전트, 코딩, 프라이빗 이미지·비디오 워크플로를 위한 30B 오픈 웨이트 멀티모달 모델 Muse Glimmer를 공개했다.
Meta는 로컬 AI 에이전트를 위한 30B Apache 2.0 멀티모달 모델 Muse Glimmer를 공개했으며, 개인적이고 저비용의 추론을 목표로 폭넓은 도구 지원을 제공한다.
Moonshot AI의 PerceptionBench는 주요 멀티모달 모델이 기본 시각 작업에서 60% 미만에 머무르며, 겉보기의 추론 오류 뒤에 있는 지각 실패를 드러낸다.
Mistral AI가 단일 카메라 내비게이션용 8B 로보틱스 모델 Robostral Navigate를 선보이며, 더 저렴한 로봇 인식 스택으로의 전환을 시사했다.
Twelve Labs가 Amazon과 벤처 투자자들로부터 1억 달러를 유치하면서, 대규모 비디오를 검색하고 분석할 수 있는 AI 시스템에 대한 수요가 커지고 있음을 보여줬다.
Google은 16GB 메모리를 탑재한 노트북에서 로컬로 실행되도록 설계된 인코더 없는 멀티모달 오픈 모델 Gemma 4 12B를 공개했다.
미라 무라티의 Thinking Machines Lab은 AI와의 지속적인 실시간 협업을 위해 설계된 상호작용 모델을 미리 공개했다.
Luma AI의 Uni-1은 자기회귀(autoregressive) 아키텍처를 사용하여 추론 벤치마크에서 Google Nano Banana 2와 OpenAI GPT Image 1.5를 능가하면서 2K 해상도 가격을 최대 30%까지 절감합니다.
샤오미는 MiMo-V2-Pro, MiMo-V2-Omni, MiMo-V2-TTS를 공개했다 — 이 세 가지 AI 모델은 1조 개가 넘는 파라미터, 멀티모달 인식 및 감성 음성 합성을 특징으로 하며, 에이전트 벤치마크에서 Claude Opus 4.6과 경쟁한다.
구글은 Gemini Embedding 2를 출시했습니다. 이는 텍스트, 이미지, 비디오를 통합된 벡터 공간으로 함께 매핑하여 검색 및 정보 검색 작업에 활용할 수 있는 최초의 본래 멀티모달 임베딩 모델입니다.
중국의 DeepSeek는 텍스트·이미지·비디오를 생성할 수 있는 V4 멀티모달 모델을 곧 출시할 예정이며, 보도에 따르면 Nvidia와 AMD에는 조기 최적화 접근을 허용하지 않고 대신 중국의 연례 의회 회의를 앞두고 화웨이와 Cambricon 등 국내 칩 제조사에만 독점적으로 제공했다고 전해진다.
DeepSeek의 채용 공고는 텍스트, 이미지 및 오디오를 지원하는 멀티모달 AI 검색 엔진 계획을 공개했으며, 구글의 검색 시장 점유율을 직접 겨냥합니다.
베이징에 본사를 둔 Moonshot AI가 OpenAI와 Anthropic에 필적하면서도 운영 비용은 4배 저렴한 오픈소스 멀티모달 AI 모델 Kimi K2.5를 공개해, 미국의 반도체 수출 통제가 중국의 AI 개발을 제약하는 데 얼마나 효과적인지에 대한 의문을 제기했다.