Anthropic dice que una investigación interna sobre Claude apunta a una capa de razonamiento separable, reavivando el debate sobre cómo piensan los modelos de lenguaje
Anthropic afirma que una nueva investigación sobre Claude encontró un espacio interno de razonamiento separable, una दावा que podría transformar la interpretabilidad y la seguridad de la IA.
