DiscoBench révèle que les agents de recherche IA échouent sur les requêtes ambiguës parce qu’ils ne demandent pas aux utilisateurs de clarifier
Un nouveau benchmark de Tencent Hunyuan et de l’Université Tsinghua suggère que les agents de recherche IA échouent face à l’ambiguïté, et non à la recherche elle-même, ce qui limite leur fiabilité dans le monde réel.
