Anthropic обнаружила в Claude незапланированную важную структуру
<p><strong>Anthropic обнаружила внутри своих моделей Claude структуру, которую разработчики не закладывали в план при проектировании. Внутренний механизм под названием «J-space» работает как общее рабочее пространство: к нему обращаются разные компоненты модели.</strong></p>
<p>Исследование от 6 июля стало заметным продвижением в понимании того, что именно происходит внутри больших языковых моделей.</p>
<section class="c-bic-highlighted-text mb-8 md:mb-12 " id="block_6a4d2d5a2a95a">
<div class="flex items-center gap-5 px-5 py-4 rounded-xl bg-grey-50 text-dark-grey-700">
<svg class="min-w-5 h-5 text-blue-600" fill="none" height="28" viewBox="0 0 28 28" width="28" xmlns="http://www.w3.org/2000/svg"><path d="m11.195 26.6 1.4-9.8h-4.9c-.812 0-.798-.448-.532-.924.266-.476.07-.112.098-.168L16.795 1.4l-1.4 9.8h4.9c.686 0 .784.462.658.714l-.098.21-9.66 14.476Z" fill="currentColor"></path></svg>
<div class="bic-block-highlighted-paragraph-content p3 p3--ns [&_p:last-child]:!mb-0 [&_p]:!leading-6 [&_p]:!font-body [&_p]:!text-4 [&_a]:!text-blue-600">
<p><strong><em>Хотите еще эксклюзивных новостей и аналитики? Подписывайтесь на наш</em></strong><a href="https://t.me/beincrypto_trading"><strong><em> телеграм-канал</em></strong></a><strong><em>, обсуждайте новости и делитесь мнениями о последних событиях рынка в чате!</em></strong></p>
</div>
</div>
</section>
<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-что-такое-j-space-внутри-claude">Что такое J-space внутри Claude</h2>
<p>J-space — это внутреннее пространство, где Claude собирает и передает важные данные по всей модели. Проще всего представить его как виртуальную доску внутри искусственного интеллекта.</p>
<p>Когда Claude отвечает на вопрос, решает задачу или выполняет инструкцию, ключевая информация появляется в J-space, чтобы разные части модели могли с ней работать.</p>
<p>Антропик <a href="https://www.anthropic.com/research/global-workspace" rel="noreferrer noopener nofollow" target="_blank">выявила</a> J-space с помощью инструмента для исследований под названием «J-lens». С его помощью исследователи наблюдали, как информация перемещается внутри модели во время выполнения задания. J-space возник сам по себе в процессе обучения — он не был заложен конструкторами напрямую.</p>
<figure class="wp-block-image size-full"><img alt="J-space у Claude во многом повторяет то, что ученые называют «глобальным рабочим пространством» в человеческом мышлении. Источник: Anthropic" class="wp-image-384911" src="https://assets.beincrypto.com/img/Dqcq4yDmgkA1ztr3ElmBTq44vuQ=/smart/c14ec18884f64e3ca46bcfc5b9fc71c1" /><figcaption class="wp-element-caption">J-space у Claude во многом повторяет то, что ученые называют «глобальным рабочим пространством» в человеческом мышлении. Источник: <a href="https://www.anthropic.com/research/global-workspace" rel="noreferrer noopener nofollow" target="_blank">Anthropic</a></figcaption></figure>
<p>Похожая идея встречается в нейронауках и носит название «глобальное рабочее пространство».</p>
<p>У человека эта система обеспечивает доступ к <a href="https://twitter.com/sporadica/status/2074221465864679754" rel="noreferrer noopener nofollow" target="_blank">важной информации</a> сразу для нескольких мыслительных процессов. Например, когда человек слышит вопрос, вспоминает нужный факт и решает, как ответить, мозг сводит все необходимые данные в одном месте.</p>
<p>Claude работает схоже. Anthropic показала, что модель может описывать содержимое J-space по запросу, а также изменять его, если об этом попросить.</p>
<p>Более того, когда исследователи вручную меняли J-space, менялись и ответы Claude, и его поведение при выполнении заданий.</p>
<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-почему-это-важно-для-безопасности-и-интерпретируемости-ии">Почему это важно для безопасности и интерпретируемости ИИ</h2>
<p>Открытие <a href="https://ru.beincrypto.com/kuper-bezopasnost-ii-hirosima-standarty/" rel="noreferrer noopener" target="_blank">имеет большое значение для безопасности искусственного интеллекта</a>. Если ученые смогут отслеживать активность J-space, у них появится шанс выявлять скрытые мотивы в поведении ИИ-моделей. За счет этого можно будет эффективнее отмечать, когда система начинает работать ненадежно.</p>
<p>В том числе — выявление атак. Мониторинг J-space позволяет увидеть момент, когда модель сталкивается с попытками prompt-injection (внедрение вредоносных инструкций в запрос, чтобы перехватить управление ответом модели). Кроме того, <a href="https://futurism.com/artificial-intelligence/anthropic-ceo-unsure-claude-conscious" rel="noreferrer noopener nofollow" target="_blank">даже частичный доступ к такому «осознанному» слою обработки</a> открывает важные перспективы для исследований.</p>
<p>Пока возможности ограничены. Большая часть обработки информации у Claude по-прежнему идет вне J-space.</p>
<p>Тем не менее Anthropic открыла исходный код реализации J-lens и выложила демоверсию Neuronpedia, предложив исследовательскому сообществу проверить результаты на практике.</p>
<p>Исследование опирается на серию более ранних работ. В октябре 2025 года Anthropic опубликовала доклад о формирующейся интроспективной осознанности. Ранее, в апреле 2025 года, компания запустила инициативы по изучению благополучия моделей, шаг за шагом продвигаясь в понимании того, что происходит внутри ее систем.</p>
<p>Есть и важная оговорка. Anthropic подчеркивает, что не заявляет, будто Claude обладает сознанием или субъективным опытом. В работе используется термин «осознанно доступная» информация, заимствованный из когнитивной науки, — он не означает наличия настоящего сознания.</p>
<p><strong><em>