PerceptionBench encuentra que los principales modelos de IA aún tienen dificultades para leer imágenes de forma fiable
PerceptionBench de Moonshot AI encuentra que los principales modelos multimodales se quedan por debajo del 60% en tareas visuales básicas, revelando fallos de percepción detrás de aparentes errores de razonamiento.
