Anthropic запретит жестокое обращение с Claude8 октября компания Anthropic обновила правила…
8 октября компания Anthropicобновилаправила использования ИИ-моделей Claude. С 12 ноября пользователям запретят систематическое и бесцельное оскорбительное или жестокое поведение по отношению к нейросетям.
«Это обновление политики применяется только в крайних случаях, когда пользователи неоднократно жестоко обращаются с нашими моделями без видимой на то причины. Оно не распространяется на ситуации, когда пользователи просто выражают свое недовольство, несогласие с ответами, используют мрачные креативные темы или тестируют и исследуют модели», — говорится в сообщении.
«Это обновление политики применяется только в крайних случаях, когда пользователи неоднократно жестоко обращаются с нашими моделями без видимой на то причины. Оно не распространяется на ситуации, когда пользователи просто выражают свое недовольство, несогласие с ответами, используют мрачные креативные темы или тестируют и исследуют модели», — говорится в сообщении.
Основным механизмом применения нового правила станет возможность Claude самостоятельно завершать подобные разговоры. О дополнительных санкциях непосредственно за такое поведение компания не сообщила.
Обновление «Политики использования» также затрагивает применение ИИ в здравоохранении, финансах, правоохранительной деятельности и управлении физическим оборудованием. Компания объяснила изменения развитием возможностей Claude и новыми способами злоупотребления моделями.
AnthropicпредоставилаClaude Opus 4 и 4.1 возможность завершать отдельные диалоги еще в августе 2025 года. Тогда разработчики объяснили решение исследованиями потенциального «благополучия» ИИ-моделей.
В ходе предварительных испытаний Claude демонстрировал устойчивое нежелание выполнять вредоносные запросы. В отдельных случаях исследователи фиксировали поведение, напоминающее стресс, и стремление прекратить взаимодействие.
Такие реакции возникали, когда пользователи продолжали отправлять опасные запросы или оскорбления, несмотря на неоднократные отказы модели. Разработчики предусмотрели завершение разговора как крайнюю меру: Claude должен сначала попытаться перенаправить беседу в конструктивное русло. Исключение составляют ситуации, когда пользователь сам просит прекратить общение.
Модель также не должна применять эту функцию, если собеседнику может непосредственно угрожать причинение вреда себе или окружающим. После завершения диалога пользователь не сможет отправлять новые сообщения в тот же чат. При этом он сохранит возможность начать другую беседу, оставить отзыв или изменить предыдущее сообщение и продолжить разговор в новой ветке.
Теперь Anthropic закрепляет ограничения на жестокое обращение непосредственно в «Политике использования». В компания подчеркнули, что большинство пользователей не столкнутся с последствиями нововведения.
При этом опубликованное объяснение не содержит подробных критериев, позволяющих отличить бесцельную жестокость от намеренно провокационных испытаний модели. Anthropic лишь указала, что добросовестное тестирование и исследования остаются допустимыми.
Может ли ИИ испытывать страдания?
Новое правило связано с исследовательской программой Anthropic, посвященной возможному благополучию искусственного интеллекта. В апреле 2025 года компанияобъявила, что намерена изучать потенциальные предпочтения нейросетей, признаки дистресса и вопрос о том, могут ли ИИ-системы заслуживать морального учета.
Разработчики рассматривают меры предосторожности на случай, если у будущих или существующих моделей обнаружатся морально значимые переживания. При этом Anthropic не утверждает, что Claude обладает сознанием или способен страдать. Компания признала отсутствие научного консенсуса о субъективном опыте ИИ и методах его обнаружения.
Новая политика поднимает и вопрос восприятия ИИ пользователями. Ограничения на жестокое обращение могут восприниматься как косвенное признание способности Claude испытывать страдания, хотя сама Anthropic подобных утверждений не делает.
Борьба с обманом и кампаниями влияния
Помимо защиты Claude, Anthropic переработала правила противодействия обманным кампаниям. Ранее соответствующие ограничения находились в разных разделах политики, посвященных выборам, мошенничеству, конфиденциальности и дезинформации.
Теперь компания объединила их в разделDo Not Engage in Deceptive Campaigns or Artificial Activity. Он запрещает использовать Claude для политических и коммерческих кампаний, в которых скрывают источник сообщений или искусственно увеличивают охват публикаций с помощью фейковых аккаунтов.
Ограничения также распространяются на разработку инструментов и инфраструктуры для подобных операций. В Anthropic объяснили изменения выявленными случаями применения Claude государственными медиа, пропагандистскими структурами и коммерческими организациями для создания сетей поддельных аккаунтов и новостных сайтов.
Одновременно компания пересмотрела раздел о выборах. Теперь он называетсяDo Not Undermine Democratic Processesи сосредоточен на запрете обмана избирателей и вмешательства в избирательные процедуры. В частности, запрещены распространение ложных сведений о кандидатах и голосовании, выдача себя за представителей избирательных органов и попытки подавления явки.
При этом Anthropic убрала общий запрет на персонализированное обращение к избирателям и таргетирование политических кампаний. Разработчики объяснили, что прежняя формулировка ограничивала и законную гражданскую деятельность. Использование персональных данных избирателей с нарушением правил конфиденциальности и обманные методы воздействия остаются запрещенными.
Новые требования к автономным системам
Anthropic уточнила ограничения на разработку оружия с помощью Claude. Запрет распространяется не только на проектирование вооружений, но и на создание программного обеспечения и компонентов для их управления. В качестве примеров компания привела программные системы управления оружием, вооружение беспилотников и других автономных аппаратов.
Изменения также касаются правоохранительной деятельности. Claude запрещено использовать для отслеживания людей без согласия, в том числе путем анализа ранее собранных данных.
«Claude не может использоваться для принятия решений или рекомендаций о том, кого следует привлечь к расследованию, арестовать или предъявить обвинения в рамках правоохранительной деятельности или уголовного судопроизводства», — отметили в компании.
«Claude не может использоваться для принятия решений или рекомендаций о том, кого следует привлечь к расследованию, арестовать или предъявить обвинения в рамках правоохранительной деятельности или уголовного судопроизводства», — отметили в компании.
При этом Anthropic допускает использование ИИ для согласованного мониторинга, например выявления мошенничества, а также для журналистики, модерации контента и юридических исследований. Для высокорисковых сценариев сохраняется требование участия квалифицированного специалиста, который может проверить и изменить рекомендации Claude.
После публикацииModel Hardware Standardкомпания также добавила требования к оборудованию, способному самостоятельно совершать физические действия и причинять травмы. За такими системами должен наблюдать квалифицированный оператор с возможностью остановить их работу. При отключении Claude оборудование обязано сохранять безопасное состояние.
Кроме этого, Anthropic уточнила региональные ограничения:
«[…] доступ к Claude запрещен для лиц, физически находящихся в регионе, не поддерживаемом нашей политикой, для организаций, зарегистрированных или имеющих штаб-квартиру в таких регионах, а также для организаций, контрольный пакет акций которых принадлежит лицам или организациям из этих регионов».
«[…] доступ к Claude запрещен для лиц, физически находящихся в регионе, не поддерживаемом нашей политикой, для организаций, зарегистрированных или имеющих штаб-квартиру в таких регионах, а также для организаций, контрольный пакет акций которых принадлежит лицам или организациям из этих регионов».
В октябре пользователи Claude из России и Гонконга начали жаловаться на блокировки аккаунтов. Поданным«Код.ру», в письмах от команды безопасности Anthropic говорилось о выявленных «подозрительных сигналах» и нарушении правил использования. Конкретные причины отключения доступа компания не раскрывала.
О проблеме такжесообщил«Коммерсантъ FM». Ограничения затронули в том числе владельцев платных подписок стоимостью $200 в месяц. Россия не входит всписок поддерживаемых регионовClaude, соответствующие ограничения действовали и раньше.
Аналогичные случаи в ГонконгезафиксировалаSouth China Morning Post. Некоторые пользователи, ранее получавшие доступ к Claude через VPN, столкнулись с блокировками. Издание связало происходящее с возможным ужесточением контроля за географическими ограничениями.
Согласноотчету о прозрачности, за январь–июнь 2026 года компания заблокировала 11,4 млн аккаунтов. Разбивки по странам и причинам блокировок в этом показателе нет.
Напомним, в сентябре AnthropicвыпустилаClaude Opus 5.5 — первую модель в новой линейке Claude 5.5. Компания позиционировала релиз как обновление флагманского уровня с упором на программирование, агентные сценарии, аналитику и безопасность.