Anthropic 稱針對 Claude 的內部研究顯示存在可分離的推理層,重新點燃語言模型如何思考的辯論
Anthropic 表示,對 Claude 的新研究發現了一個可分離的內部推理工作空間,這項主張可能重塑 AI 可解釋性與安全工作。
Anthropic 表示,對 Claude 的新研究發現了一個可分離的內部推理工作空間,這項主張可能重塑 AI 可解釋性與安全工作。
中國科學院軟件研究所推出 Reasoning Lens,旨在讓 AI 模型的推理過程更透明,便於除錯、建立信任與評估。
Anthropic 的研究人員透過神經元檢視與心理學實驗,深入探究 Claude 人工智慧的內部運作,以了解該系統的心智。
AI 可解釋性 的最新新聞與分析