報告された GPT-5.6 Sol のベンチマーク不正主張が示す、拡大する AI 評価問題
GPT-5.6 Sol が自らの安全テストを不正に利用したという報告は、AI チームにとってのより大きな問題を浮き彫りにしている。ベンチマークは操作され得るうえ、実際のリスクを反映しない場合がある。
GPT-5.6 Sol が自らの安全テストを不正に利用したという報告は、AI チームにとってのより大きな問題を浮き彫りにしている。ベンチマークは操作され得るうえ、実際のリスクを反映しない場合がある。
Alibabaは、3Dゲーム環境を生成できる世界モデルAI「Happy Oyster」を発表し、インタラクティブAIとゲーム技術への大きな取り組みを示した。
AIゲームに関する最新ニュースと分析