3DNews AI→ original

Anthropic descobre que Claude pensa em conceitos abstratos sem palavras

A Anthropic descobriu que o modelo de linguagem Claude formou independentemente um espaço interno para armazenar conceitos sem traduzi-los em palavras. Pesquisadores da empresa observam que o mecanismo é surpreendentemente semelhante a como o cérebro humano opera com pensamentos antes da verbalização a descoberta se tornou parte do trabalho sobre interpretabilidade de modelos.

Processado por IA de 3DNews AI; editado por Hamidun News
Anthropic descobre que Claude pensa em conceitos abstratos sem palavras
Fonte: 3DNews AI. Colagem: Hamidun News.
◐ Ouvir artigo

Anthropic descobriu que seu modelo de linguagem Claude formou independentemente um espaço interno "sistema" para armazenar e processar conceitos que não podem ser expressos em palavras — um mecanismo inesperadamente similar a como o cérebro humano opera com pensamentos antes de verbalizá-los. A própria empresa observou que a descoberta surpreendeu até os pesquisadores.

O que exatamente os pesquisadores encontraram

Os especialistas de Anthropic estudaram as representações internas do modelo — como Claude armazena e conecta conceitos dentro de suas camadas, muito antes de produzir texto terminado. Descobriu-se que o modelo processa alguns conceitos de forma abstrata, sem traduzi-los em palavras específicas do idioma, apenas mais tarde desdobrando-os em texto na saída.

  • Anthropic descreve o mecanismo descoberto como um "espaço sistema" para conceitos não revestidos de palavras
  • A empresa enfatiza a similaridade com como o pensamento humano opera com ideias antes de expressá-las
  • A descoberta foi feita como parte da pesquisa de interpretabilidade — tentativas de entender o que acontece dentro do modelo, não apenas o que ele produz

Por que as empresas olham dentro do modelo

Os grandes modelos de linguagem têm funcionado há muito tempo como uma "caixa preta": os desenvolvedores viam entrada e saída, mas não o que acontecia entre elas. Anthropic é um dos líderes no campo de interpretabilidade, que tenta encontrar conceitos individuais e cadeias de processamento dentro de redes neurais. A empresa tem publicado pesquisa de interpretabilidade por vários anos e periodicamente relata novos padrões de comportamento que surpreendem até os próprios pesquisadores.

Tais descobertas são importantes não apenas de um ponto de vista científico. Entender como o modelo processa informações antes de gerar uma resposta ajuda a explicar suas decisões com mais precisão, encontrar causas de erros e alucinações, e aumentar a confiança em sistemas que estão sendo cada vez mais aplicados em negócios e tarefas cotidianas.

O que significa

Se os modelos realmente formam suas próprias estruturas para armazenar significado que nem sempre são traduzíveis em palavras, isso muda nossa compreensão de como o "pensamento" está organizado profundamente em modelos de linguagem modernos — e simultaneamente complica a tarefa de sua interpretabilidade completa e controle.

ZK
Hamidun News
Notícias de AI sem ruído. Seleção editorial diária de mais de 50 fontes. Produto de Zhemal Khamidun, Head of AI na Alpina Digital.

Quer parar de ler sobre IA e começar a usar?

AI News é um feed curado de notícias de IA. A Hamidun Academy ensina você a usar IA no trabalho.

O que você acha?
Carregando comentários…