Anthropic раскрыла детали работы водяных знаков Claude: что это значит для рынка
В середине августа 2026 года Anthropic официально опубликовала технические подробности того, как будут работать невидимые водяные знаки в текстовых ответах её флагманской модели Claude. Решение, анонсированное 10 августа и вступившее в силу для новых моделей с 2 августа 2026 года, стало прямым ответом на требования статьи 50 Европейского закона об искусственном интеллекте (EU AI Act) о прозрачности AI-генерируемого контента. Это событие — не просто техническая деталь, а поворотный момент для всей индустрии генеративных моделей, затрагивающий миллионы пользователей по всему миру.
Что именно произошло
Anthropic объявила, что все новые модели Claude, выпущенные начиная с 2 августа 2026 года, будут автоматически встраивать в генерируемый текст «незаметный» (imperceptible) водяной знак. Ключевая особенность — механизм применяется глобально, а не только в странах Евросоюза. Как пояснила компания, на данный момент не существует достаточно надёжного и устойчивого способа ограничить применение водяных знаков по географическому принципу, поэтому маркировка будет единой для всех пользователей Claude по всему миру.
Важно подчеркнуть: водяной знак не является видимым текстом, скрытым символом или метаданными. Это статистический паттерн, встроенный непосредственно в процесс генерации токенов. Он не изменяет смысл, качество или читаемость текста, не добавляет лишних токенов и, следовательно, не увеличивает стоимость использования.
Технические детали: как работает водяной знак
Anthropic официально подтвердила, что использует подход SynthID-Text, разработанный командой Google DeepMind и описанный в статье, опубликованной в журнале Nature в 2024 году. Принцип работы основан на использовании «случайности» при выборе следующего слова в последовательности.
Большие языковые модели генерируют текст по одному токену за раз. При выборе следующего слова модель оценивает вероятности множества кандидатов. Например, во фразе «Сегодня погода холодная, и…» следующим словом почти наверняка не будет «сладкая», но с равной вероятностью могут подойти «пасмурная» или «серая». В обычном режиме выбор между такими равнозначными вариантами определяется случайным числом. Водяной знак использует именно эти «низкорисковые» выборы.
Механизм работает следующим образом:
- Модель больше не использует произвольный генератор случайных чисел для выбора между равнозначными словами.
- Вместо этого выбор определяется секретным ключом и несколькими предыдущими словами.
- Слова остаются случайными и естественными, но теперь последовательность можно проверить: если она соответствует паттерну, который Claude создал бы с использованием ключа, можно рассчитать вероятность того, что текст сгенерирован именно Claude.
Anthropic приводит наглядную аналогию с игрой в «Монополию». Вместо броска кубиков для определения случайности ходов используется книга с цифрами числа π. Игроки не замечают разницы — ходы остаются случайными. Но если после игры увидеть всю последовательность ходов и знать значение π, можно определить, что игра велась именно по этой схеме. Так и с текстом: читатель не видит разницы, но детектор с ключом может выявить паттерн.
Ограничения и нюансы технологии
Anthropic честно перечислила ограничения своей системы, что важно для понимания реальных возможностей технологии:
| Сценарий | Поведение водяного знака |
|---|---|
| Короткие тексты | Детекция менее надёжна — меньше слов, меньше статистического материала |
| Фактологический текст | Водяной знак разрежен — мало свободы выбора слов без потери точности |
| Лёгкое редактирование | Водяной знак, скорее всего, сохранится |
| Полная переписывание | Водяной знак удаляется (но спорно, можно ли такой текст считать AI-сгенерированным) |
| Код | Минимальное количество водяных знаков — код требует точности |
| Перевод | Водяной знак присутствует — каждое слово выбрано Claude |
| Корректура человеческого текста | Водяной знак может отсутствовать — почти все слова написаны человеком |
Особенно важный нюанс: водяной знак не доказывает авторство. Он лишь показывает вероятность того, что Claude участвовал в создании или обработке текста. Система не может отличить «текст написан Claude» от «текст сильно отредактирован Claude». Кроме того, водяной знак не содержит никакой идентифицирующей информации — его невозможно отследить до конкретного пользователя, организации или истории чата.
Изображения и файлы: стандарт C2PA
Для файлов (PNG, JPG, SVG) Anthropic использует другой механизм — стандарт C2PA (Coalition for Content Provenance and Authenticity). Это открытый отраслевой стандарт, который добавляет в метаданные файла цифровую подпись, подтверждающую, что файл был создан или обработан Claude. Тот же стандарт используют производители камер и редакторы изображений для записи происхождения контента.
Важно отметить разницу: в отличие от текстового водяного знака, метаданные C2PA не встраиваются в содержимое файла — они хранятся в метаданных и могут быть удалены при копировании в простой текстовый редактор. Именно поэтому для обычного текста Anthropic выбрала встраивание водяного знака непосредственно в лингвистическую структуру.
Рыночный контекст: почему это происходит именно сейчас
Решение Anthropic — не изолированный шаг, а часть масштабного регуляторного сдвига. 2 августа 2026 года вступили в силу обязательства по прозрачности статьи 50 EU AI Act. Согласно новым правилам, провайдеры генеративных AI-систем обязаны маркировать синтетически созданный или изменённый контент в машиночитаемой форме.
В июле 2026 года Anthropic вместе с другими крупными разработчиками моделей подписала Кодекс практики по прозрачности AI-генерируемого контента. Всего к документу присоединились около 190 подписантов, включая OpenAI, Google, Meta, Microsoft, Black Forest Labs и Synthesia. Это означает, что водяные знаки станут отраслевым стандартом, а не уникальной особенностью Claude.
За несоблюдение требований предусмотрены серьёзные штрафы — до 15 миллионов евро или 3% от глобального годового оборота компании. Для старых моделей, выпущенных до 2 августа 2026 года, установлен переходный период — они должны быть обновлены до декабря 2026 года.
Конкурентная динамика
Интересно, что подходы конкурентов различаются. Google, например, в августе 2026 года разрешила пользователям Gemini отключать видимые водяные знаки в углу изображений, но при этом невидимые водяные знаки SynthID и метаданные C2PA остаются встроенными всегда. Эта функция недоступна в странах, где закон требует обязательного сохранения видимых меток.
OpenAI, в свою очередь, использует двойную систему: контентные сертификаты (content credentials) и водяные знаки SynthID. Компания заявила в конце июля 2026 года, что будет использовать оба механизма для обеспечения прозрачности.
Рынок технологий водяных знаков активно растёт. По данным Research and Markets, рынок AI-водяных знаков оценивался примерно в 746,6 млн долларов в 2025 году и, по прогнозам, вырастет до 3,87 млрд долларов к 2034 году (среднегодовой темп роста 22,9%). Рынок цифровой атрибуции (provenance) оценивается в 4,2 млрд долларов в 2026 году с прогнозом роста до 16,9 млрд долларов к 2033 году (CAGR 21,9%).
Реакция пользователей и рынка
Внедрение водяных знаков вызвало неоднозначную реакцию. Согласно отчётам TechCrunch и Business Insider, «десятки» пользователей на платформе X заявили о намерении отменить свои подписки на Claude. Некоторые пользователи, отменившие подписку Claude Max стоимостью 100 долларов в месяц, выразили опасения, что невидимая AI-метка на их коде или корпоративных документах может привести к вопросам об авторстве или проблемам с комплаенсом.
На Reddit мнения разделились. Один пользователь назвал новую систему «драконовским заговором», направленным против невинных пользователей, другой возразил: «Единственная причина, по которой вы не хотите этого, — это желание лгать людям». Опросы и обсуждения показывают, что в целом поддержка водяных знаков преобладает, но оппозиция активна и громкая.
Важно отметить, что Anthropic планирует выпустить бесплатный API для детекции водяных знаков, который позволит пользователям и третьим сторонам самостоятельно проверять, содержит ли текст водяной знак Claude. Это существенно отличается от подхода сторонних AI-детекторов, таких как Pangram или Turnitin, которые анализируют стилистические «приметы» AI-текста (например, частое использование конструкций «это не X, это Y»). Водяной знак — это принципиально иной метод: он ищет намеренно встроенный сигнал, а не оценивает внешний вид текста.
Перспективы и прогнозы
В ближайшие месяцы стоит ожидать нескольких ключевых событий:
- Запуск детекционного API — Anthropic подтвердила, что работает над его реализацией, но точные сроки пока не названы.
- Обновление старых моделей — до декабря 2026 года все ранее выпущенные модели Claude должны получить поддержку водяных знаков.
- Расширение отраслевого стандарта — поскольку около 190 компаний подписали Кодекс практики, водяные знаки станут повсеместным явлением в индустрии.
- Эволюция методов обхода — исследователи продолжат искать способы обхода водяных знаков, что приведёт к развитию более устойчивых методов.
Технология водяных знаков продолжит развиваться. Уже существуют более продвинутые подходы, такие как MirrorMark (разработка Университета Джорджа Мейсона) и SemaMark, которые устойчивее к перефразированию и редактированию. Хотя Anthropic официально использует SynthID-Text, отрасль движется к более семантически устойчивым методам маркировки.
Итог: стоит ли использовать Claude
Для большинства пользователей водяные знаки не изменят практический опыт работы с Claude. Качество текста не пострадает, стоимость не вырастет, а скорость останется прежней. Для обычных пользователей, студентов и профессионалов, использующих Claude для легитимных целей, водяной знак — невидимая и безвредная деталь.
Однако для тех, кто использовал Claude для создания контента, который должен выглядеть как написанный человеком (например, для академических работ, SEO-контента или маркетинговых материалов), водяной знак создаёт новые риски. Важно понимать: водяной знак не доказывает авторство, но повышает вероятность обнаружения AI-участия, особенно в длинных текстах.
Рекомендация: если вы используете Claude для легитимных целей — продолжайте использовать. Если вы полагаетесь на Claude для создания контента, который должен проходить как человеческий, — пересмотрите свою стратегию, поскольку отрасль движется к полной прозрачности AI-контента.
FAQ
Можно ли удалить водяной знак из текста Claude?
Частично. Лёгкое редактирование, скорее всего, не удалит водяной знак полностью. Полное переписывание каждого слова удалит его, но в этом случае текст уже сложно назвать AI-сгенерированным. Короткие тексты и тексты с высокой фактологической плотностью содержат меньше водяных знаков и их труднее детектировать.
Водяной знак раскрывает мою личность или организацию?
Нет. Водяной знак привязан к модели Claude и её выводам, но не содержит никакой идентифицирующей информации о конкретном пользователе, организации или истории чата. Ни водяной знак, ни ключ не позволяют восстановить личность пользователя.
Чем водяной знак Claude отличается от AI-детекторов вроде Pangram или Turnitin?
Это принципиально разные методы. Водяной знак — это намеренно встроенный статистический сигнал, который ищется с помощью секретного ключа. AI-детекторы анализируют стилистические особенности готового текста (частоту определённых слов, конструкции, предсказуемость) и пытаются классифицировать его как AI-сгенерированный. Водяной знак надёжнее и точнее, но требует доступа к ключу.