Anthropic destaca la investigación de interpretabilidad de Claude y sostiene que puede rastrear partes del razonamiento interno de un modelo
Anthropic afirma que la nueva investigación de interpretabilidad de Claude puede rastrear partes del razonamiento del modelo, un paso notable para la seguridad de la IA, la depuración y la confianza empresarial.
