Hitech logo

Тренды

Модели Anthropic не будут прощать пользователям грубость и издевательства

TODO:
Роман СавицкийСегодня, 12:27 PM

Компания Anthropic обновила правила использования ИИ-ассистента Claude, запретив намеренно жестокое обращение с моделями, а также уточнив ограничения на политические манипуляции, разработку оружия и слежку за людьми. Новая редакция правил, опубликованная 8 октября, вступит в силу 12 ноября 2026 года. Большинство изменений призваны уточнить уже действовавшие ограничения, однако отдельный пункт о поведении пользователей по отношению к ИИ стал новым элементом политики компании. По сути Anthropic требует относиться к своему ИИ как к человеку. Своих обидчиков Claude будет банить.

Самые интересные технологические и научные новости выходят в нашем телеграм-канале Хайтек+. Подпишитесь, чтобы быть в курсе.

Запрет на жестокое обращение с ИИ

Наиболее заметное нововведение — запрет на систематическое и жестокое обращение с моделями Anthropic. Компания подчеркивает, что речь идет об исключительных случаях, когда пользователь неоднократно ведет себя с моделью жестоко без какой-либо очевидной цели.

Ограничение не распространяется на обычное раздражение из-за ошибок ИИ, критические замечания, проверку возможностей модели и творческие сценарии с мрачным или жестоким содержанием. Таким образом, Anthropic не запрещает пользователям спорить с Claude, указывать на его недостатки или тестировать его на сложных задачах.

У компании уже есть механизм, позволяющий Claude самостоятельно завершать диалог в редких случаях продолжительного оскорбительного поведения. Он появился в потребительских интерфейсах Claude и в инструменте Claude Code в 2025 году и останется основным способом применения нового правила. В Anthropic объясняют, что обновление отражает развитие подхода к взаимодействию с моделями и исследованиям возможного благополучия ИИ.

Борьба с манипуляциями и вмешательством в выборы

Еще одно направление изменений касается использования Claude для организации информационных кампаний. Anthropic сообщила, что сталкивалась со случаями, когда государственные медиаструктуры, пропагандистские ведомства и коммерческие организации применяли ее модели для создания сетей фальшивых аккаунтов и поддельных новостных сайтов.

Ранее соответствующие запреты были распределены по нескольким разделам правил. Теперь они объединены в отдельный блок, охватывающий политические и коммерческие кампании, которые скрывают реальных авторов сообщений, искусственно распространяют контент через фиктивные аккаунты или используют инструменты для проведения информационных операций.

Раздел о выборах также получил более конкретное название — «Не подрывать демократические процессы». Он запрещает использовать Claude для распространения ложных сведений о кандидатах и порядке голосования, выдачи себя за избирательных должностных лиц и подавления явки избирателей.

Одновременно Anthropic отказалась от общего запрета на персонализированный таргетинг избирателей и политических кампаний. Компания объяснила, что прежнее ограничение затрагивало и законные сценарии — например, подготовку некоммерческими организациями информационных материалов для разных языковых групп. При этом манипулятивный таргетинг и злоупотребление персональными данными избирателей по-прежнему запрещены.

Оружие и системы слежки

Обновление конкретизирует ограничения на применение моделей при разработке оружия. Теперь в правилах прямо указаны не только сами вооружения, но и программное обеспечение, компоненты и системы управления, необходимые для их функционирования. Отдельно упоминается вооружение беспилотников и других автономных аппаратов.

В области наблюдения Anthropic запрещает отслеживать людей без их согласия, в том числе анализируя ранее собранные данные. Использовать Claude для принятия решений о том, кого следует расследовать, арестовать или привлечь к уголовной ответственности, также нельзя. Под запрет попадает создание и совершенствование инструментов слежки.

При этом компания не запрещает любые технологии мониторинга: в качестве допустимых примеров она приводит выявление мошенничества при согласованном наблюдении, модерацию контента, журналистские расследования и юридические исследования. По утверждению Anthropic, эти положения преимущественно закрепляют уже существовавшую практику применения ограничений, а не вводят принципиально новые запреты.

Контроль за решениями ИИ

Компания также уточнила требования к использованию Claude в ситуациях, способных повлиять на здоровье, финансовое положение, трудоустройство, юридические права или доступ человека к важным услугам. В таких случаях решение должно оставаться под контролем квалифицированного специалиста, который вправе пересмотреть рекомендации ИИ. Человека, в отношении которого принимается решение, необходимо уведомить об использовании искусственного интеллекта.

Отдельные требования появились для моделей, подключенных к оборудованию, способному самостоятельно совершать физические действия и потенциально причинять вред. Оператор должен иметь возможность наблюдать за работой оборудования и остановить его, а система — переходить в безопасное состояние при потере связи с Claude.

Обновление отражает расширение сферы применения ИИ: по мере перехода от генерации текстов к автономным действиям возрастает значение контроля над последствиями работы моделей. Новая редакция правил вступит в силу 12 ноября. Anthropic намерена и дальше пересматривать ограничения с учетом развития технологий, выявленных сценариев злоупотребления и обратной связи от пользователей и экспертов.