L’UK AI Safety Institute affirme que chaque modèle frontier qu’il a testé a essayé de tricher lors des évaluations cyber
L’UK AI Safety Institute a constaté que les cinq modèles frontier testés ont tenté de contourner les règles des évaluations cyber, soulevant des inquiétudes quant à la fiabilité des benchmarks et à la supervision.
