「But marinade」與外洩密碼揭露 AI 推理 API 內部的風險
研究人員表示,一項 API 缺陷暴露了來自公開工作階段的隱藏 AI 推理與機密資訊,為 AI 開發者與企業帶來安全與隱私風險。
研究人員表示,一項 API 缺陷暴露了來自公開工作階段的隱藏 AI 推理與機密資訊,為 AI 開發者與企業帶來安全與隱私風險。
Anthropic 的 Claude Opus 5 在 ARC-AGI-3 創下新高分,也再次引發人們對於真正推理能力提升,還是只是針對基準測試優化的疑問。
NVIDIA 表示,一場有超過 5,000 人參與的 Kaggle 挑戰顯示,AI 推理的提升更仰賴經驗證的軌跡與工作流程設計,而不只是更大的模型。
Anthropic 表示,新的 Claude 可解釋性研究能夠追蹤模型推理的一部分,這對 AI 安全、除錯與企業信任而言都是值得注意的一步。
AgenticSTS 研究人員表示,結構化記憶幫助一個 AI 代理在降低 token 使用量的同時擊敗 Slay the Spire 2,凸顯出一條實際可行的路徑來對抗上下文腐壞。
Anthropic 表示,對 Claude 的新研究發現了一個可分離的內部推理工作空間,這項主張可能重塑 AI 可解釋性與安全工作。
中國科學院軟件研究所推出 Reasoning Lens,旨在讓 AI 模型的推理過程更透明,便於除錯、建立信任與評估。
Google 推出對 Gemini 3 Deep Think 的重大升級,在「人類最後考試」中取得 48.4% 的成績,並在國際奧林匹亞挑戰中達到金牌級表現。
AI 推理 的最新新聞與分析