Anthropic Encontrou Padrões Neurais em Claude Semelhantes a um \'Espaço de Trabalho Global\'
Em 6 de julho de 2026, Anthropic publicou em transformer-circuits.pub o estudo \'Representações Verbalizáveis Formam um Espaço de Trabalho Global em Modelos de Linguagem\'. Pesquisadores mostraram: modelos de linguagem como Claude possuem um pequeno conjunto de padrões neurais internos que podem ser expressos em palavras e controlados — diferentemente do resto do processamento, que ocorre automaticamente.
Processado por IA de Habr AI; editado por Hamidun News
Anthropic publicou um estudo em 6 de julho de 2026 no site transformer-circuits.pub intitulado "Verbalizable Representations Form a Global Workspace in Language Models" — sobre como os modelos de linguagem como Claude formam uma estrutura estruturalmente similar ao que os neurocientistas chamam de espaço de trabalho global da consciência.
O que Anthropic descobriu
Os autores do estudo partem de uma analogia com o cérebro humano. Enquanto um humano lê uma frase, o cérebro simultaneamente realiza dezenas de processos que a pessoa não percebe: mantém a postura, regula a respiração, converte linhas na tela em palavras reconhecíveis. Mas parte dessa atividade ainda está acessível à consciência — uma imagem emergida, uma decisão considerada, direção da atenção. Os neurocientistas chamam tal atividade de conscientemente acessível e a distinguem dos processos automáticos: tem propriedades especiais — pode ser descrita em palavras, pode ser controlada, e o raciocínio pode ser baseado nela.
- Data de publicação — 6 de julho de 2026
- Editora — Anthropic, desenvolvedora da família de modelos Claude
- Título do trabalho — Verbalizable Representations Form a Global Workspace in Language Models
- Plataforma de publicação — transformer-circuits.pub, seção de pesquisa da Anthropic sobre interpretabilidade de modelos
De acordo com o estudo, uma divisão similar foi encontrada em modelos de linguagem: o modelo encontrou um pequeno conjunto de padrões neurais internos que, contra o pano de fundo de todo o outro processamento, desempenham um papel especial — podem ser expressos em palavras (verbalizable), ao contrário de um volume muito maior de computações internas que permanecem completamente "não-verbalizáveis" e fluem por si só, analogamente aos processos automáticos no cérebro.
Por que isso é importante para a interpretabilidade da IA
Anthropic há muito estuda a estrutura interna de seus modelos como parte de um programa de interpretabilidade mecanística — tentativas de entender o que exatamente acontece dentro de uma rede neural entre o texto de entrada e a resposta de saída, em vez de apenas avaliar o modelo por suas respostas de fora. A descoberta de uma estrutura análoga a um espaço de trabalho global fornece aos pesquisadores uma nova ferramenta: se parte das representações internas do modelo está realmente estruturada como um subsistema "reportável", isso abre uma maneira mais precisa de verificar o que o modelo realmente "sabe" e pode relatar sobre seus próprios estados internos, e o que permanece oculto mesmo do próprio modelo. Tal distinção é especialmente importante dado que os modelos de linguagem são cada vez mais usados em cenários onde precisam não apenas fornecer uma resposta, mas explicar o curso de seu raciocínio — por exemplo, em cadeias de pensamento (chain-of-thought) ou quando pedido a um modelo para explicar por que tomou uma decisão particular.
O que isso significa
O estudo não afirma que os modelos de linguagem têm consciência no sentido humano — mostra uma analogia estrutural: um pequeno conjunto verificável de representações internas separadas do restante do processamento automático. Para a interpretabilidade da IA, este é um passo significativo: entender qual parte dos processos internos do modelo é em princípio acessível para verificação e relato verbal, e qual não é, afeta diretamente quanto você pode confiar nas explicações que o modelo dá sobre seu próprio raciocínio.
Perguntas Frequentes
Quando foi lançado o estudo de
Anthropic sobre espaço de trabalho global em LLMs?
O estudo "Verbalizable Representations Form a Global Workspace in Language Models" foi publicado pela Anthropic em 6 de julho de 2026 no site transformer-circuits.pub.
O que é um espaço de trabalho global no contexto de modelos de linguagem?
Este é um pequeno conjunto de padrões neurais internos de um modelo que podem ser expressos em palavras e que podem ser controlados — por analogia com a parte da função cerebral humana que é conscientemente acessível, em contraste com os processos automáticos que ocorrem sem atenção.
Quer parar de ler sobre IA e começar a usar?
AI News é um feed curado de notícias de IA. A Hamidun Academy ensina você a usar IA no trabalho.
O essencial da IA — uma vez por semana
Sete histórias que realmente importaram, escolhidas a dedo. Sem ruído nem releases.
Pronto! Verifique seu e-mail para a confirmação.