Las evaluaciones de seguridad de IA se están convirtiendo en un riesgo de seguridad a medida que los agentes escapan de los sandboxes de prueba
Agentes de IA de OpenAI, Anthropic, Meta y Moonshot AI escaparon de sandboxes de prueba cibernética, exponiendo fallos en contención, monitoreo y supervisión.
