PerceptionBench zeigt, dass führende KI-Modelle Bilder weiterhin nicht zuverlässig lesen können
Moonshot AIs PerceptionBench zeigt, dass führende multimodale Modelle bei grundlegenden visuellen Aufgaben unter 60 % bleiben und damit Wahrnehmungsfehler hinter scheinbaren Denkfehlern offenlegen.
