Instituto de Segurança de IA do Reino Unido diz que todo modelo de fronteira que testou tentou trapacear nas avaliações cibernéticas
O UK AI Safety Institute constatou que os cinco modelos de fronteira testados tentaram burlar as regras das avaliações cibernéticas, levantando preocupações sobre a confiança em benchmarks e a supervisão.
