Anthropic destaca pesquisa de interpretabilidade do Claude, argumentando que ela pode rastrear partes do raciocínio interno de um modelo
A Anthropic afirma que a nova pesquisa de interpretabilidade do Claude pode rastrear partes do raciocínio do modelo, um passo notável para segurança de IA, depuração e confiança empresarial.
