Водяной знак встраивается непосредственно в сгенерированный текст и сохраняется при копировании и вставке. В некоторых случаях он может пережить последующее редактирование. Модели Claude, выпущенные со 2 августа 2026 года, начнут маркировать сгенерированные тексты сразу с момента запуска, а для более старых версий компания планирует внедрить функцию позднее.
Маркировка стала частью мер Anthropic по выполнению требований европейского Закона об искусственном интеллекте, в частности, статьи 50 о прозрачности контента, созданного ИИ. При этом она будет применяться ко всему контенту, который генерируют поддерживаемые модели Claude, независимо от страны пользователя. Anthropic также намерена предоставить сторонним организациям инструменты для обнаружения своих водяных знаков и опубликовать технические подробности работы системы.
Для медиафайлов компания использует другой подход: изображения и документы других поддерживаемых форматов снабжаются цифровой подписью по стандарту C2PA. Эти метаданные подтверждают, что файл создан или обработан моделью Claude. Однако, в отличие от текстовой маркировки, такая защита менее устойчива — метка может удалиться при конвертации формата, создании скриншота или повторном сохранении.
В Anthropic рассчитывают, что новая технология поможет выявлять случаи, когда ИИ-контент выдаётся за человеческий. Для издательской индустрии это особенно актуально: в последние годы уже возникали громкие споры вокруг книг, авторов которых подозревали в использовании генеративного ИИ.
При этом компания подчеркивает, что водяной знак не сможет служить доказательством авторства.
Редактирование, перефразирование, перевод или смешивание текста Claude с другими материалами могут сделать маркировку незаметной. Кроме того, знак может появиться в тексте, который изначально написал человек, но затем использовал Claude для перевода, редактирования или обобщения. И, наоборот, отсутствие маркировки не означает, что текст написан человеком.
Anthropic стала второй крупной технологической компанией, внедряющей подобную систему для текстового контента. В 2024 году Google DeepMind представила технологию SynthID для маркировки текста и видео, созданных Gemini, а годом ранее — ее версию для изображений.

