DiscoBench zeigt, dass KI-Suchagenten bei mehrdeutigen Anfragen scheitern, weil sie Nutzer nicht um Klarstellung bitten
Ein neuer Benchmark von Tencent Hunyuan und der Tsinghua University legt nahe, dass KI-Suchagenten an Mehrdeutigkeit scheitern – nicht an der Suche selbst –, was ihre Zuverlässigkeit in der Praxis einschränkt.
