Anthropic affirme qu’une recherche interne sur Claude pointe vers une couche de raisonnement séparée, ravivant les débats sur la manière dont les modèles de langage pensent
Anthropic dit que de nouvelles recherches sur Claude ont mis au jour un espace de raisonnement interne séparé, une affirmation qui pourrait remodeler l’interprétabilité et la sécurité de l’IA.
