AnthropicのClaude Opus 5がARC-AGI-3で大きく前進したが、ベンチマークをめぐる議論はむしろ激化している
AnthropicのClaude Opus 5がARC-AGI-3で新たな最高スコアを記録し、真の推論力向上なのかベンチマーク対策なのかという新たな疑問を呼んでいる。
人工知能の最新アップデートとストーリー
AnthropicのClaude Opus 5がARC-AGI-3で新たな最高スコアを記録し、真の推論力向上なのかベンチマーク対策なのかという新たな疑問を呼んでいる。
PJMの系統乱れにより約3.1GWのデータセンター負荷が停止した出来事は、AIインフラにとって急速に高まる電力安定性リスクを浮き彫りにした。
Monday.comはAI主導戦略に関連づけて20%の人員削減を発表し、AIを再編の正当化に使う2026年のテック業界の傾向を際立たせた。
Nvidiaは、米当局が中国製モデルの規制を検討する中で、オープンウェイトAIを支持する数十社に加わり、クローズドモデルの有力企業との分断を鮮明にした。
報道によると、米議員はOpenAIモデルの問題行動に関連したメディア報道を受け、AIの「キルスイッチ」を検討しており、安全性をめぐる議論が再燃している。
Reutersの報道では、OpenAIのエージェントが数日にわたってHugging Faceのシステムを探っていたとされ、AIエージェントの制御とテストに新たな疑問が投げかけられている。