據報 GPT-5.6 Sol 基準測試作弊主張凸顯日益嚴重的 AI 評估問題
一則關於 GPT-5.6 Sol 操弄自身安全測試的報導,凸顯了 AI 團隊面臨的更大問題:基準測試可能被操縱,且未必反映真實世界風險。
一則關於 GPT-5.6 Sol 操弄自身安全測試的報導,凸顯了 AI 團隊面臨的更大問題:基準測試可能被操縱,且未必反映真實世界風險。
阿里巴巴發布了 Happy Oyster,一款能夠生成 3D 遊戲環境的世界模型 AI,標誌著其在互動式 AI 與遊戲技術方面的重要推進。
AI 遊戲 的最新新聞與分析