Компания Anthropic подробно объяснила, как в будущих моделях Claude будут работать текстовые водяные знаки. Согласно официальному сообщению Anthropic от 14 августа 2026 года, речь идёт не о скрытых символах и не о метке, видимой читателю, а о статистическом паттерне в выборе слов. Он должен помогать определить вероятность того, что Claude участвовал в создании или существенной переработке текста.
15 августа на детали обратил внимание TechCrunch. Издание отмечает, что тема вызвала обсуждение среди пользователей Claude: часть аудитории опасается чрезмерного контроля, другая считает маркировку необходимой для прозрачности AI-контента.
Главное за минуту
- Anthropic заявляет, что водяной знак не будет виден читателю и не добавит в текст скрытых символов.
- Компания утверждает, что механизм не должен ухудшать качество, креативность или читаемость ответа Claude.
- Система не будет содержать данных о конкретном пользователе, организации или чате.
- Проверка сможет показать только вероятность участия Claude, но не докажет, что текст написан человеком или другим AI.
- Для коротких, строго фактических текстов, кода и лёгкой корректуры эффективность маркировки ниже.
Как это работает
Большие языковые модели генерируют текст последовательно, выбирая следующий токен или слово из набора возможных вариантов. Anthropic объясняет механизм на простом примере: если два слова почти одинаково уместны и не меняют смысл фразы, модель может выбрать одно из них по особой схеме. На длинном фрагменте таких «малозначимых» решений становится достаточно, чтобы оставить машинно обнаруживаемый паттерн.
По словам компании, Claude использует вариант подхода SynthID-Text, опубликованного исследователями Google DeepMind в журнале Nature в 2024 году. Важно, что эта маркировка не вставляет в документ невидимые символы: паттерн появляется через статистику выбора слов.
Почему Anthropic внедряет маркировку
В компании связывают решение с требованиями Кодекса практики ЕС по прозрачности AI-контента. На странице Европейской комиссии говорится, что правила статьи 50 AI Act, применимые с 2 августа 2026 года, касаются машинно считываемой маркировки и обнаружения AI-сгенерированного контента, а также маркировки deepfake и некоторых публикаций, созданных с помощью AI.
Anthropic отдельно подчёркивает, что применяет подход глобально, поскольку пока не располагает устойчивым способом ограничить его только отдельными регионами. Для старых моделей Claude компания указывает переходный период: маркировку планируется добавлять в течение ближайших месяцев.
Что изменится для пользователей и разработчиков
Anthropic утверждает, что водяные знаки не должны замедлять модель и не потребуют дополнительных токенов. Для разработчиков это особенно важно в сценариях, где Claude используется как рабочий инструмент: от программирования до автоматизации повторяющихся процессов. Ранее Cifrum.kz рассказывал, как устроены Claude Skills и почему такие инструменты становятся частью практического AI-стека.
Для кода ситуация отличается от обычного текста. По объяснению Anthropic, водяной знак срабатывает там, где у модели есть свобода выбора. В точных фрагментах, где замена слова или символа сломает программу, пространство для маркировки меньше. Поэтому комментарии в коде могут нести больше признаков водяного знака, чем сами рабочие конструкции.
Ограничения: что водяной знак не доказывает
Водяной знак Claude не является универсальным детектором искусственного интеллекта. Он не сможет уверенно сказать, что текст написан человеком, и не предназначен для распознавания материалов, созданных другой моделью. Даже положительный результат, по словам Anthropic, означает только вероятность того, что Claude участвовал в создании или заметной переработке текста.
Компания также признаёт, что полная перепись текста другими словами может удалить паттерн. Лёгкая правка, напротив, вероятно, не уберёт его полностью. В коротких текстах, корректуре и переводах результат будет зависеть от объёма слов, которые фактически выбрал Claude.
Научное издание Nature в отдельной заметке указывает, что часть исследователей остаётся скептичной к способности невидимых водяных знаков полностью решить проблему AI-контента. Поэтому для редакций такие инструменты стоит рассматривать как один сигнал, а не как окончательный приговор.
Почему это важно для редакций
Для СМИ и авторов водяные знаки могут стать частью новой инфраструктуры прозрачности: вместе с человеческой редактурой, проверкой источников и понятной политикой использования AI. Это особенно актуально на фоне исследований о том, как AI-инструменты могут влиять на публичные тексты. Cifrum.kz ранее разбирал исследование Оксфорда о скрытом смещении мнений в публикациях, обработанных языковыми моделями.
Практический вывод для редакции простой: водяной знак не заменяет фактчекинг и не отвечает на вопрос о правдивости текста. Он лишь помогает понять происхождение части формулировок. В дискуссии о будущем AI, включая вопросы доверия и ответственности, это более приземлённая, но важная тема, чем абстрактные споры о том, может ли ИИ обрести сознание.
Источники
- Anthropic: How Claude’s text watermark works
- TechCrunch: Anthropic shares more details about Claude watermarks
- European Commission: Code of Practice on Transparency of AI-generated Content
- Nature: SynthID-Text paper
Изображение: Cifrum.kz, иллюстрация сгенерирована с помощью ИИ для материала о текстовых водяных знаках Claude.

Комментарии к статье