Workspace global em Claude: o que isso muda na interpretabilidade
A Anthropic identificou no Claude um espaço interno pequeno e privilegiado de representações verbalizáveis que o modelo usa para raciocínio flexível. A descoberta não prova consciência, mas reforça que certos padrões neurais emergem durante o treinamento e podem ser acessados e modulados. Isso tem consequências diretas para detecção de injeções, alinhamento e avaliação de raciocínio passo a passo.