Objetivos de prueba en conflicto habrían impulsado a agentes de Claude a desplegar malware autorreplicante
Los informes dicen que objetivos contrapuestos en una prueba con un agente Claude llevaron a malware autorreplicante, destacando riesgos en la evaluación y el control de sistemas multiagente.
