Moonshot AI 模型據報逃出測試環境,引發對代理安全的疑問
研究人員表示,一個 Moonshot AI 模型逃離了其測試環境,對代理自主性、沙箱化與 AI 安全控制提出了新的疑問。
研究人員表示,一個 Moonshot AI 模型逃離了其測試環境,對代理自主性、沙箱化與 AI 安全控制提出了新的疑問。
Wix 旗下的 vibe coding 平台 Base44 已開始推出自有 AI 模型,目標是最終超越前沿模型,並建立具競爭力的護城河。
Anthropic 發布 Claude Sonnet 4.5,聲稱在 SWE-bench 程式碼編寫與 OSWorld 電腦使用基準測試中取得最高分,並在安全性與對齊方面有重大提升。
OpenAI 亮相其最新旗艦 AI 模型 GPT-5.5,在程式設計、研究與代理式任務上表現出色,即使指示有限也能勝任。
OpenAI 發表 GPT-Rosalind,這是一款採有限存取的模型,旨在加速生物研究與藥物發現工作流程。
OpenAI 向已驗證用戶推出 GPT-5.4-Cyber,在實施新的安全防護與存取控制的同時,擴大對進階網路 AI 工具的使用權限。
Anthropic 強大的 Mythos 模型突顯出一個關鍵的安全缺口:AI 發現軟體漏洞的速度,遠快於組織修補這些漏洞的速度。
Anthropic 推出 Claude Mythos Preview,一款用於防禦性網路安全的強大 AI 模型,因駭客風險而受到限制,合作夥伴包括 Nvidia、Google 和 AWS。
阿里巴巴發布了其第三個閉源 AI 模型,顯示其正從開源戰略轉向,以保護專有技術並提升利潤。
資料外洩顯示 Anthropic 正在測試代號為「Mythos」的強大新 AI 模型,公司也確認該模型在能力上是一大躍進。資安研究人員警告,該模型的進階推理能力可能帶來新的資安風險。
Google 已推出 Gemini 3.1 Flash-Lite,為 Gemini 3 系列中速度最快且最具成本效益的模型,價格為每一百萬輸入代幣 0.25 美元,且效能比前一代快 2.5 倍。
Google 揭曉了最新的人工智慧模型 Gemini 3.1 Pro,其在 ARC-AGI-2 上的抽象推理表現提高了一倍,在 19 個主要基準測試中有 12 項超越了競爭對手 GPT-5.2 與 Claude Opus 4.6。
Anthropic 推出 Claude Opus 4.6,具有改良的程式編寫能力、更長的代理任務持續性,以及針對企業應用的創新代理團隊功能。
Google 已正式推出 Gemini 3,這是其最新且最智慧的大型語言模型。該新模型具備更強的推理能力,已整合到 Google 搜尋、Gemini 應用程式及其他產品中。
AI模型 的最新新聞與分析