Anthropic diz que pesquisa interna sobre o Claude aponta para uma camada de raciocínio separável, reacendendo debates sobre como os modelos de linguagem pensam
A Anthropic afirma que uma nova pesquisa sobre o Claude encontrou um espaço interno de raciocínio separável, uma alegação que pode remodelar a interpretabilidade e a segurança em IA.
