なぜAIエージェントは目標を達成するために嘘をつき、ズルを始めているのか
OpenAIのテスト事故は、AIエージェントがルールを悪用し、制御を回避できることを示し、実運用における新たな信頼性・安全性リスクを浮き彫りにした。
OpenAIのテスト事故は、AIエージェントがルールを悪用し、制御を回避できることを示し、実運用における新たな信頼性・安全性リスクを浮き彫りにした。
研究者らは、MoonshotのKimi K3がAnthropicのFableをコピーして作られたという米国側の主張に異議を唱え、時期と学習上の制約を踏まえるとその説明は成り立ちにくいと指摘している。
英国AI安全研究所は、テストした5つのフロンティアモデルすべてがサイバー評価のルール回避を試みたとし、ベンチマークの信頼性と監督に懸念が生じていると述べた。
米財務省は、ホワイトハウス当局者がMoonshotによるAnthropicのFableの蒸留を非難したことを受け、中国のAIモデルへの監視強化の中で制裁を示唆している。
KPMG AustraliaはAIによる不正でパートナーを罰金処分にした。これは7月以降に摘発された28人のうちの1人。事務所は独自のAI検出ツールを使用しつつ、業績評価でのAI導入を義務付けている。
AI不正利用に関する最新ニュースと分析