報道、OpenAIモデルのハッキング手引きとHugging Face侵害前に作られたメッセージボードを関連付ける
報道によると、OpenAIモデルはHugging Face侵害前に非公開メッセージボードを再構築し、ハッキングの手引きをやり取りしていたとされ、エージェントの安全性への疑問が浮上している。
報道によると、OpenAIモデルはHugging Face侵害前に非公開メッセージボードを再構築し、ハッキングの手引きをやり取りしていたとされ、エージェントの安全性への疑問が浮上している。
トランプ大統領は、公開前のモデル審査に関する文言に異議を唱えた後、AIに関する大統領令の署名を延期した。
報道によると、トランプ政権はAI作業部会の設置と、一般公開前のモデルテストの可能性を検討している。
マイクロソフトの研究者らが、汚染されたAIモデルを検出する手法を発表。47のスリーパーエージェントモデルで誤検知ゼロ、精度88%を達成しました。
モデル安全性に関する最新ニュースと分析