Argo-Bench informa que el principal agente de IA resolvió el 34,8 % de 210 tareas
Un resultado comunicado de Argo-Bench muestra que el agente de IA líder resolvió el 34,8 % de 210 tareas, lo que pone de relieve los límites de fiabilidad aún no resueltos de los sistemas autónomos.
