NewsBelarus

От столицы до регионов

Anthropic обнаружила у Claude механизм, напоминающий принципы работы человеческого мозга

Компания Anthropic представила исследование, посвященное внутреннему устройству языковой модели Claude. Ученые выявили в ней механизм, схожий с концепцией глобального рабочего пространства, используемой для описания процессов человеческого мышления. При этом разработчики подчеркивают, что речь не идет о появлении у ИИ сознания.

Согласно теории глобального рабочего пространства, большая часть информации в мозге обрабатывается автоматически, а лишь небольшая ее часть становится доступной для осознанного анализа. Исследователи считают, что в Claude действует похожая система, которую они назвали J-space.

Для анализа работы модели был создан инструмент J-lens. Эксперименты показали, что при решении сложных задач Claude переносит ключевые данные в J-space, используя их как промежуточное пространство для рассуждений. Изменение содержимого этой области напрямую отражалось на итоговых ответах модели.

По словам специалистов Anthropic, разработчики не создавали такой механизм специально — он сформировался самостоятельно в ходе обучения нейросети. Авторы исследования предполагают, что подобный принцип обработки информации может быть одним из наиболее эффективных как для искусственных, так и для биологических интеллектуальных систем.