3DNews AI→ оригинал

Anthropic обнаружила, что Claude мыслит абстрактными понятиями без слов

Anthropic обнаружила, что языковая модель Claude самостоятельно сформировала внутреннее пространство для хранения понятий, которые не переводит в слова. Исследователи компании отмечают, что механизм неожиданно похож на то, как человеческий мозг оперирует мыслями до их вербализации — находка стала частью работы над интерпретируемостью моделей.

AI-обработка оригинала 3DNews AI; редакция Hamidun News
Anthropic обнаружила, что Claude мыслит абстрактными понятиями без слов
Источник: 3DNews AI. Коллаж: Hamidun News.
◐ Слушать статью

Компания Anthropic обнаружила, что её языковая модель Claude самостоятельно сформировала внутреннее «системное» пространство для хранения и обработки понятий, которые не выражаются словами — механизм, неожиданно напоминающий то, как человеческий мозг оперирует мыслями до их вербализации. Об этом сообщили в самой компании, отметив, что находка удивила даже исследователей.

Что именно нашли исследователи

Специалисты Anthropic изучали внутренние представления модели — то, как Claude хранит и связывает понятия внутри своих слоёв, задолго до того, как выдаёт готовый текст. Оказалось, что часть концепций модель обрабатывает в абстрактном виде, не переводя их в конкретные слова языка, а лишь позже разворачивая в текст на выходе.

  • Anthropic описывает найденный механизм как «системное пространство» для необлечённых в слова понятий
  • Компания подчёркивает сходство с тем, как человеческое мышление оперирует идеями до их проговаривания
  • Находка сделана в рамках исследований интерпретируемости — попыток понять, что происходит внутри модели, а не только что она выдаёт на выходе

Зачем компании заглядывают внутрь модели

Крупные языковые модели долгое время работали как «чёрный ящик»: разработчики видели вход и выход, но не то, что происходит между ними. Anthropic — один из лидеров направления интерпретируемости (interpretability), которое пытается найти внутри нейросетей отдельные концепции и цепочки их обработки. Компания уже несколько лет публикует исследования о том, как модели формируют внутренние представления понятий, и периодически сообщает о новых, неожиданных для самих исследователей паттернах поведения.

Подобные находки важны не только с научной точки зрения. Понимание того, как модель обрабатывает информацию до генерации ответа, помогает точнее объяснять её решения, находить причины ошибок и галлюцинаций и повышать доверие к системам, которые всё активнее применяются в бизнесе и повседневных задачах.

Что это значит

Если модели действительно формируют собственные, не всегда переводимые в слова структуры для хранения смысла, это меняет представление о том, насколько глубоко устроено «мышление» современных языковых моделей — и одновременно усложняет задачу их полной интерпретируемости и контроля.

ЖХ
Hamidun News
AI‑новости без шума. Ежедневный редакторский отбор из 50+ источников. Продукт Жемала Хамидуна, Head of AI в Alpina Digital.

Хотите не читать про ИИ, а внедрить его?

«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.

Что вы думаете?
Загружаем комментарии…