PerceptionBench mostra que os principais modelos de IA ainda têm dificuldade para ler imagens de forma confiável
O PerceptionBench da Moonshot AI mostra que os principais modelos multimodais ficam abaixo de 60% em tarefas visuais básicas, expondo falhas de percepção por trás de aparentes erros de raciocínio.
