OpenAI, 내부 Frontier 모델의 수학 연구 결과 공유
OpenAI가 내부 Frontier 모델의 수학 연구 결과와 Lean 형식화 및 연구 세부 정보를 공유해 개발자들이 검토할 수 있는 자료를 확대했다.
인공지능의 최신 업데이트 및 스토리
OpenAI가 내부 Frontier 모델의 수학 연구 결과와 Lean 형식화 및 연구 세부 정보를 공유해 개발자들이 검토할 수 있는 자료를 확대했다.
OpenAI와 Ironclad는 복잡한 계약 업무 워크플로에서 AI 에이전트를 훈련하고 평가하며, 직장에서 더욱 고도화된 컴퓨터 사용을 향한 경로를 시험하고 있다.
Mistral AI가 오픈 및 폐쇄형 경쟁자를 겨냥한 1조 매개변수 멀티모달 모델 Mistral Large 4를 공개했다. 다만 안전성 테스트를 위해 가중치 공개는 늦춰진다.
Mistral이 Mistral Large 4를 오픈 웨이트 모델로 출시하면서 AI 팀이 통제된 배포와 맞춤화를 위해 평가할 수 있는 또 하나의 모델을 제공했다.
보도에 따르면 DeepSeek가 최대 150억 달러 규모의 자금 조달을 검토하고 있으며, 정보 공개에 공백이 있는 가운데서도 중국 AI에 대한 투자자들의 관심이 커지고 있음을 보여준다.
Mistral CEO는 새 AI 모델이 사이버보안을 비롯한 일부 분야에서 중국 경쟁 모델보다 뛰어나다고 밝혔지만, 독립적인 벤치마크 세부 내용은 공개되지 않았다.
GitHub의 공개 ReviewBench 벤치마크는 AI 코드 리뷰 에이전트를 테스트하는 더 명확한 방법을 제시하며, 개발자와 구매자에게 공통 평가 출발점을 제공한다.
Reka AI의 Rho-1은 텍스트, 이미지, 비디오, 로봇 제어를 하나의 190억 매개변수 연구 모델에 결합하며 통합 AI 시스템을 향한 움직임을 보여준다.
DeepSeek가 Tencent, CATL 및 다른 투자자들로부터 최소 120억 달러를 조달하려 한다는 보도가 나왔다. 이는 중국 AI 인프라 경쟁에서 자금 조달 능력을 시험하는 계기가 될 수 있다.
OpenAI가 EU 내 ChatGPT 텍스트에 보이지 않는 워터마크를 추가할 것으로 알려졌다. 이는 AI 콘텐츠 공개 절차를 바꿀 수 있는 컴플라이언스 조치다.
Gizmodo의 헤드라인은 OpenAI와 Anthropic에 대한 새로운 위협을 지적하지만, 제공된 기록에는 기사의 근거가 빠져 있으며 위협도 식별되지 않았다.
Reflection AI가 첫 오픈 모델 Beam을 출시하면서 접근 가능한 AI 시스템을 둘러싼 미·중 경쟁이 더욱 치열해지고 개발자들의 선택지도 확대됐다.