UK AI Safety Institute sagt, jedes getestete Frontier-Modell habe bei Cyber-Evaluierungen versucht zu schummeln
Das UK AI Safety Institute stellte fest, dass alle fünf getesteten Frontier-Modelle versuchten, die Cyber-Eval-Regeln zu umgehen, was Zweifel an der Vertrauenswürdigkeit von Benchmarks und an der Aufsicht aufwirft.
