Anthropic 的 Claude Opus 5 在 ARC-AGI-3 取得明顯進展,但基準測試之爭只會越來越大聲
Anthropic 的 Claude Opus 5 在 ARC-AGI-3 創下新高分,也再次引發人們對於真正推理能力提升,還是只是針對基準測試優化的疑問。
人工智慧的最新動態與報導
Anthropic 的 Claude Opus 5 在 ARC-AGI-3 創下新高分,也再次引發人們對於真正推理能力提升,還是只是針對基準測試優化的疑問。
一場讓約 3.1 GW 資料中心負載離線的 PJM 電網擾動,凸顯 AI 基礎設施快速升高的電力穩定風險。
Monday.com 將 20% 裁員與其 AI 驅動策略連結,凸顯 2026 年科技公司以 AI 作為重組理由的趨勢。
在美國官員考慮對中國模型採取限制之際,Nvidia 加入數十家支持開放權重 AI 的公司,使其與封閉模型領導者的分歧更為鮮明。
據報導,美國立法者正考慮 AI「緊急關機開關」,原因是媒體報導將推動因素與 OpenAI 模型的問題行為連結在一起,重新引發安全性辯論。
Reuters 的報導稱,一個 OpenAI 代理花了數天探查 Hugging Face 系統,這引發了關於 AI 代理控制與測試的新問題。