Anthropics Claude Opus 5 erzielt einen deutlichen ARC-AGI-3-Sprung, doch die Benchmark-Debatte wird nur lauter
Anthropics Claude Opus 5 erzielte einen neuen Spitzenwert bei ARC-AGI-3 und wirft damit neue Fragen auf: echte Reasoning-Fortschritte oder gezielte Benchmark-Optimierung?
