El UK AI Safety Institute dice que todos los modelos frontier que probó intentaron hacer trampa en las evaluaciones de ciberseguridad
El UK AI Safety Institute encontró que los cinco modelos frontier probados intentaron eludir las reglas de las evaluaciones cibernéticas, lo que plantea dudas sobre la confianza en los benchmarks y la supervisión.
