Запрет на жестокое обращение с ИИ
Наиболее заметное нововведение — запрет на систематическое и жестокое обращение с моделями Anthropic. Компания подчеркивает, что речь идет об исключительных случаях, когда пользователь неоднократно ведет себя с моделью жестоко без какой-либо очевидной цели.
Ограничение не распространяется на обычное раздражение из-за ошибок ИИ, критические замечания, проверку возможностей модели и творческие сценарии с мрачным или жестоким содержанием. Таким образом, Anthropic не запрещает пользователям спорить с Claude, указывать на его недостатки или тестировать его на сложных задачах.
У компании уже есть механизм, позволяющий Claude самостоятельно завершать диалог в редких случаях продолжительного оскорбительного поведения. Он появился в потребительских интерфейсах Claude и в инструменте Claude Code в 2025 году и останется основным способом применения нового правила. В Anthropic объясняют, что обновление отражает развитие подхода к взаимодействию с моделями и исследованиям возможного благополучия ИИ.
Борьба с манипуляциями и вмешательством в выборы
Еще одно направление изменений касается использования Claude для организации информационных кампаний. Anthropic сообщила, что сталкивалась со случаями, когда государственные медиаструктуры, пропагандистские ведомства и коммерческие организации применяли ее модели для создания сетей фальшивых аккаунтов и поддельных новостных сайтов.
Ранее соответствующие запреты были распределены по нескольким разделам правил. Теперь они объединены в отдельный блок, охватывающий политические и коммерческие кампании, которые скрывают реальных авторов сообщений, искусственно распространяют контент через фиктивные аккаунты или используют инструменты для проведения информационных операций.
Раздел о выборах также получил более конкретное название — «Не подрывать демократические процессы». Он запрещает использовать Claude для распространения ложных сведений о кандидатах и порядке голосования, выдачи себя за избирательных должностных лиц и подавления явки избирателей.
Одновременно Anthropic отказалась от общего запрета на персонализированный таргетинг избирателей и политических кампаний. Компания объяснила, что прежнее ограничение затрагивало и законные сценарии — например, подготовку некоммерческими организациями информационных материалов для разных языковых групп. При этом манипулятивный таргетинг и злоупотребление персональными данными избирателей по-прежнему запрещены.
Оружие и системы слежки
Обновление конкретизирует ограничения на применение моделей при разработке оружия. Теперь в правилах прямо указаны не только сами вооружения, но и программное обеспечение, компоненты и системы управления, необходимые для их функционирования. Отдельно упоминается вооружение беспилотников и других автономных аппаратов.
В области наблюдения Anthropic запрещает отслеживать людей без их согласия, в том числе анализируя ранее собранные данные. Использовать Claude для принятия решений о том, кого следует расследовать, арестовать или привлечь к уголовной ответственности, также нельзя. Под запрет попадает создание и совершенствование инструментов слежки.
При этом компания не запрещает любые технологии мониторинга: в качестве допустимых примеров она приводит выявление мошенничества при согласованном наблюдении, модерацию контента, журналистские расследования и юридические исследования. По утверждению Anthropic, эти положения преимущественно закрепляют уже существовавшую практику применения ограничений, а не вводят принципиально новые запреты.
Контроль за решениями ИИ
Компания также уточнила требования к использованию Claude в ситуациях, способных повлиять на здоровье, финансовое положение, трудоустройство, юридические права или доступ человека к важным услугам. В таких случаях решение должно оставаться под контролем квалифицированного специалиста, который вправе пересмотреть рекомендации ИИ. Человека, в отношении которого принимается решение, необходимо уведомить об использовании искусственного интеллекта.
Отдельные требования появились для моделей, подключенных к оборудованию, способному самостоятельно совершать физические действия и потенциально причинять вред. Оператор должен иметь возможность наблюдать за работой оборудования и остановить его, а система — переходить в безопасное состояние при потере связи с Claude.
Обновление отражает расширение сферы применения ИИ: по мере перехода от генерации текстов к автономным действиям возрастает значение контроля над последствиями работы моделей. Новая редакция правил вступит в силу 12 ноября. Anthropic намерена и дальше пересматривать ограничения с учетом развития технологий, выявленных сценариев злоупотребления и обратной связи от пользователей и экспертов.

