Запись архива

Anthropic добавит невидимый водяной знак в тексты Claude: что это значит для пользователей

Будущие модели Claude будут помечать сгенерированный текст невидимым водяным знаком на основе метода SynthID-Text от Google DeepMind. Anthropic внедряет это ради выполнения требований EU AI Act — разбираем, как работает технология и какие у нее ограничения.

Схематичное изображение невидимого водяного знака в тексте, сгенерированном искусственным интеллектом
Схематичное изображение невидимого водяного знака в тексте, сгенерированном искусственным интеллектом
Claude 3.5 Sonnet example screenshot.webp | by Software: Anthropic PBC
Artwork and Screenshot:

VulcanSphere | wikimedia_commons | Public domain

Anthropic объявила, что будущие модели Claude будут помечать генерируемый текст невидимым водяным знаком. Это часть выполнения требований EU AI Act: со 2 августа 2026 года поставщики ИИ-моделей, работающих на рынке Евросоюза, обязаны маркировать созданный ИИ контент. Разъяснение опубликовано в официальном блоге компании 14 августа 2026 года.

Водяной знак основан на методе SynthID-Text, который Google DeepMind описала в статье в Nature в 2024 году. Та же линейка подходов восходит к предложению Скотта Ааронсона 2022 года. По словам Anthropic, маркировка не влияет на качество текста, не добавляет скрытых символов и не увеличивает стоимость генерации. При этом она применяется глобально, а не только для пользователей из ЕС.

Как работает водяной знак

Языковые модели выбирают следующее слово из списка кандидатов. В случаях, когда несколько вариантов одинаково приемлемы («пасмурно» или «серо» в предложении про холодную погоду), выбор обычно определяется случайным числом. Водяной знак меняет источник этой случайности: вместо произвольного генератора чисел используются ключ и несколько предыдущих слов.

Читатель не замечает разницы — оформление и смысл текста не меняются, скрытых символов не добавляется. Но тот, у кого есть ключ, может проанализировать последовательность слов и оценить вероятность того, что текст создан Claude. Случайность выбора сохраняется: модель не начинает подбирать редкие или неестественные слова.

Влияет ли маркировка на качество

Anthropic утверждает, что внутренние тесты не показали влияния водяного знака на содержание, креативность и читабельность текстов Claude. Google DeepMind в работе SynthID-Text проверяла метод на части реального трафика Gemini: пользователи ставили оценки «палец вверх» и «палец вниз», статистически значимой разницы с моделью без водяного знака не нашлось. В контролируемом исследовании человеческие рецензенты также не отличили помеченные ответы от непомеченных.

В блоге приводится аналогия с настольной игрой, где случайность берется не из броска кости, а из заранее известной последовательности цифр числа пи. Игроки не замечают разницы, но наблюдатель, знающий правило, может впоследствии определить способ определения ходов.

Где детекция не сработает

У метода есть четкие ограничения. Водяной знак плохо определяется на коротких фрагментах: чем меньше слов выбрала модель, тем меньше информации для анализа. На фактологичных текстах, где слово практически предопределено (например, «Principia Mathematica» после слов о главном труде Ньютона), маркировке не за что зацепиться.

Аналогичная ситуация с вычиткой: если Claude лишь исправляет грамматику и пунктуацию в человеческом тексте, знак остается только в небольшом числе правок, которых может не хватить для надежного вывода. С кодом похожая история: там, где требуется точный синтаксис, водяной знак не применяется, хотя может появляться в произвольных местах вроде комментариев.

Детекция по ключу не подтверждает, что текст написан человеком, и не отличает Claude от другой ИИ-модели. Знак также не позволяет понять, написал ли Claude текст с нуля или сильно отредактировал чужой.

Что меняется для пользователей

Anthropic подчеркивает, что водяной знак не содержит идентифицирующей информации о пользователе, организации или чатах: по ключу нельзя восстановить, кто именно работал с моделью. Маркировка не требует дополнительных токенов, не замедляет генерацию и не меняет цены.

Компания также анонсировала API для проверки текста на наличие водяного знака — детали реализации пока не раскрыты. Для файлов изображений (PNG, JPG, SVG) используется другой механизм: C2PA-креденшелы в метаданных, которые подписываются криптографически и не меняют сам файл.

Обход возможен лишь частично: легкое редактирование водяной знак, скорее всего, не удалит, а полная переписка текста — да, но в этом случае вопрос, можно ли такой текст считать сгенерированным ИИ, остается открытым. Переводы, созданные Claude, маркируются, так как каждое слово выбирает модель.

Почему Anthropic делает это сейчас

EU AI Act со 2 августа 2026 года требует от поставщиков ИИ-моделей, обслуживающих рынок ЕС, маркировать сгенерированный контент. В июле 2026 года Anthropic подписала Кодекс практики ЕС по прозрачности ИИ-контента — всего у документа около 190 подписантов, включая других крупных разработчиков моделей.

Водяной знак применяется глобально, потому что у компании пока нет надежного способа ограничить его по регионам. Для моделей, запущенных до 2 августа 2026 года, действует переходный период; Anthropic планирует добавить маркировку и для них в течение ближайших месяцев.

Что пока не подтверждено

Anthropic не раскрыла сроки запуска детекционного API и его формат — будет ли это бесплатный инструмент для всех или сервис с ограничениями. Неясно также, как маркировка будет проявляться при вызове Claude через сторонние интерфейсы и API-партнеров. Компания обещает публиковать обновления по мере продвижения.

Факт Детали Источник
Срок вступления требований 2 августа 2026 года EU AI Act / Anthropic
Метод маркировки SynthID-Text от Google DeepMind (Nature, 2024) Anthropic
Подписанты Кодекса практики около 190, включая Anthropic Anthropic
Влияние на качество не выявлено в тестах Anthropic и DeepMind Anthropic
Детекционный API анонсирован, детали не раскрыты Anthropic

Источник: https://www.anthropic.com/news/claude-text-watermark