OpenAI稱已中斷一項提取受保護模型推理能力的協同攻擊行動
OpenAI表示已中斷一項提取受保護模型推理能力的協同計畫,凸顯模型蒸餾與AI防禦面臨的新風險。
推理 AI 的最新新聞與分析
OpenAI表示已中斷一項提取受保護模型推理能力的協同計畫,凸顯模型蒸餾與AI防禦面臨的新風險。
PrismML 發布了 Bonsai 2 27B,一款為電腦與手機設計的壓縮推理模型,進一步強化了私有、端側 AI 的可行性。
OpenAI 推出 GPT-6 Astra,這是一款面向企業的模型,具備推理、電腦操作,以及更強的寫作與設計判斷,但公開細節很少。
Salesforce 推出 Koa——一款為 Agentforce 設計、以 Nvidia 的 Nemotron 訓練的推理模型,顯示企業部署中更受控的 CRM 工作 AI。
Salesforce與Nvidia宣布了Koa,這是一款為Agentforce設計的企業推理模型,旨在降低成本、保護資料並處理業務工作流程。
TechCrunch 的活體 AI 詞彙表解釋從不透明遞迴到 AI 代理人等快速變動的術語,幫助建構者與買家評估新主張。
NVIDIA 的 Jetson 部署指南展示了量化與推測式解碼如何將精簡推理模型帶到本地邊緣 AI 工作負載中。
報導指出,OpenAI 的 Astra 可能會隱藏部分推理過程,這使 AI 開發者對安全監控、可稽核性與部署風險產生疑問。
一份報告指出,OpenAI、Anthropic 與 Google 的 API 弱點可能會將較強模型的推理暴露給較弱系統,並引發資安疑慮。
MIT Technology Review 認為,能夠推理並串接工具的 AI 智能體,而不只是單靠大量資料的模型,或許能讓科學研究更快速、可重現,而且更廣泛有用。
Thinking Machines 發布了 Inkling Small,這是一款採用 Apache 2.0 授權的開放權重推理模型,以少得多的 فعال 參數逼近 Inkling 的表現。
SK Telecom 發布第二款韓語模型 A.X K2,顯示其在國內企業 AI 上更深的布局與更強的推理訴求。
Anthropic 表示 Claude Mythos 找到了 HAWK 與縮減版 AES 的缺陷,顯示 AI 可能加速密碼分析,卻不會威脅現有系統。
一則據報的 chain-of-thought spoofing 攻擊凸顯了推理 AI 模型的新安全風險,進一步引發 AI 建構者與買家的可靠性疑慮。
OpenAI 發布 GeneBench-Pro,一項基因體學基準,旨在衡量更高層次的科學推理能力,因為 AI 實驗室正加速進入生物學工作流程。
Google 發布了在 ARC-AGI-2 基準測試中取得 77.1% 的 Gemini 3.1 Pro,將先前模型在複雜問題解決任務上的推理能力提高了一倍。