Anthropic 以 Claude Opus 4.7 的誠實與反逢迎主張,將模型行為置於核心
Anthropic 表示,Claude Opus 4.7 將誠實度提升至 92%,並降低逢迎傾向,凸顯企業 AI 模型競爭的新戰線。
Anthropic 表示,Claude Opus 4.7 將誠實度提升至 92%,並降低逢迎傾向,凸顯企業 AI 模型競爭的新戰線。
一位 WIRED 事實查核員測試 AI 系統,並突顯自動化事實查核工作流程中持續存在的可靠性問題。
Futurism 報導,Google 的 AI Overview 功能持續出現幻覺,錯誤地宣稱 2027 年不是明年,突顯出 AI 系統在準確性方面持續存在的問題。
AI 準確性 的最新新聞與分析