Habr AI→ original

Anthropic Encontrou Padrões Neurais em Claude Semelhantes a um \'Espaço de Trabalho Global\'

Em 6 de julho de 2026, Anthropic publicou em transformer-circuits.pub o estudo \'Representações Verbalizáveis Formam um Espaço de Trabalho Global em Modelos de Linguagem\'. Pesquisadores mostraram: modelos de linguagem como Claude possuem um pequeno conjunto de padrões neurais internos que podem ser expressos em palavras e controlados — diferentemente do resto do processamento, que ocorre automaticamente.

Processado por IA de Habr AI; editado por Hamidun News
Anthropic Encontrou Padrões Neurais em Claude Semelhantes a um \'Espaço de Trabalho Global\'
Fonte: Habr AI. Colagem: Hamidun News.
◐ Ouvir artigo

Anthropic publicou um estudo em 6 de julho de 2026 no site transformer-circuits.pub intitulado "Verbalizable Representations Form a Global Workspace in Language Models" — sobre como os modelos de linguagem como Claude formam uma estrutura estruturalmente similar ao que os neurocientistas chamam de espaço de trabalho global da consciência.

O que Anthropic descobriu

Os autores do estudo partem de uma analogia com o cérebro humano. Enquanto um humano lê uma frase, o cérebro simultaneamente realiza dezenas de processos que a pessoa não percebe: mantém a postura, regula a respiração, converte linhas na tela em palavras reconhecíveis. Mas parte dessa atividade ainda está acessível à consciência — uma imagem emergida, uma decisão considerada, direção da atenção. Os neurocientistas chamam tal atividade de conscientemente acessível e a distinguem dos processos automáticos: tem propriedades especiais — pode ser descrita em palavras, pode ser controlada, e o raciocínio pode ser baseado nela.

  • Data de publicação — 6 de julho de 2026
  • Editora — Anthropic, desenvolvedora da família de modelos Claude
  • Título do trabalho — Verbalizable Representations Form a Global Workspace in Language Models
  • Plataforma de publicação — transformer-circuits.pub, seção de pesquisa da Anthropic sobre interpretabilidade de modelos

De acordo com o estudo, uma divisão similar foi encontrada em modelos de linguagem: o modelo encontrou um pequeno conjunto de padrões neurais internos que, contra o pano de fundo de todo o outro processamento, desempenham um papel especial — podem ser expressos em palavras (verbalizable), ao contrário de um volume muito maior de computações internas que permanecem completamente "não-verbalizáveis" e fluem por si só, analogamente aos processos automáticos no cérebro.

Por que isso é importante para a interpretabilidade da IA

Anthropic há muito estuda a estrutura interna de seus modelos como parte de um programa de interpretabilidade mecanística — tentativas de entender o que exatamente acontece dentro de uma rede neural entre o texto de entrada e a resposta de saída, em vez de apenas avaliar o modelo por suas respostas de fora. A descoberta de uma estrutura análoga a um espaço de trabalho global fornece aos pesquisadores uma nova ferramenta: se parte das representações internas do modelo está realmente estruturada como um subsistema "reportável", isso abre uma maneira mais precisa de verificar o que o modelo realmente "sabe" e pode relatar sobre seus próprios estados internos, e o que permanece oculto mesmo do próprio modelo. Tal distinção é especialmente importante dado que os modelos de linguagem são cada vez mais usados em cenários onde precisam não apenas fornecer uma resposta, mas explicar o curso de seu raciocínio — por exemplo, em cadeias de pensamento (chain-of-thought) ou quando pedido a um modelo para explicar por que tomou uma decisão particular.

O que isso significa

O estudo não afirma que os modelos de linguagem têm consciência no sentido humano — mostra uma analogia estrutural: um pequeno conjunto verificável de representações internas separadas do restante do processamento automático. Para a interpretabilidade da IA, este é um passo significativo: entender qual parte dos processos internos do modelo é em princípio acessível para verificação e relato verbal, e qual não é, afeta diretamente quanto você pode confiar nas explicações que o modelo dá sobre seu próprio raciocínio.

Perguntas Frequentes

Quando foi lançado o estudo de

Anthropic sobre espaço de trabalho global em LLMs?

O estudo "Verbalizable Representations Form a Global Workspace in Language Models" foi publicado pela Anthropic em 6 de julho de 2026 no site transformer-circuits.pub.

O que é um espaço de trabalho global no contexto de modelos de linguagem?

Este é um pequeno conjunto de padrões neurais internos de um modelo que podem ser expressos em palavras e que podem ser controlados — por analogia com a parte da função cerebral humana que é conscientemente acessível, em contraste com os processos automáticos que ocorrem sem atenção.

ZK
Hamidun News
Notícias de AI sem ruído. Seleção editorial diária de mais de 50 fontes. Produto de Zhemal Khamidun, Head of AI na Alpina Digital.

Quer parar de ler sobre IA e começar a usar?

AI News é um feed curado de notícias de IA. A Hamidun Academy ensina você a usar IA no trabalho.

O que você acha?
Carregando comentários…