AIエージェントの行動測定への新たな注目が高まり、安全性への懸念はモデルから行動へ移っている
The Guardian と Cybersecurity Insiders の報道は、企業が安全リスクを見極めるなか、AIエージェントを本番投入前に測定しようとする新たな動きを浮き彫りにしている。
The Guardian と Cybersecurity Insiders の報道は、企業が安全リスクを見極めるなか、AIエージェントを本番投入前に測定しようとする新たな動きを浮き彫りにしている。
5つのAIラボが、8月1日までに共通のジェイルブレイク評価スケールを支持していると報じられており、より比較可能なAIモデル安全性テストに向けた初期段階の動きとみられている。
非営利のAI組織であるMETRのチャートは、大規模AIシステムの急速な発展を追跡する中で、業界全体の熱狂の的となっている。
AI測定に関する最新ニュースと分析