Anthropic заявила о внедрении невидимых водяных знаков в ответы Claude на прошлой неделе. Компания объяснила это требованиями Закона ЕС об ИИ: уже скоро весь синтетический контент от крупных моделей должен быть машиночитаемо помечен. Однако программисты не заставили себя ждать — первые обходные пути появились в тот же день.
Что такое невидимая маркировка и почему её сложно заметить
Водяной знак в тексте — это не картинка и не скрытый символ. Anthropic использует технику SynthID, разработанную Google. Модель выбирает слова и фразы так, что человек читает текст как обычно, но специальный алгоритм может определить, что его написала нейросеть. При этом смысл и качество ответов не страдают.
По сути, маркировка встраивается в саму структуру текста. Убрать её вручную невозможно — нужно менять формулировки, порядок предложений или весь стиль.

Как программисты снимают маркировку
Самый громкий пример — код Гийома Мейера. Он появился на GitHub через четыре часа после анонса Anthropic и быстро разлетелся: больше 20 000 закладок в X, свыше ста контрибьюторов. Идея в том, чтобы пропустить текст из Claude через другую языковую модель без водяных знаков. Такая модель переписывает текст, заменяя слова синонимами и меняя структуру, — после этого исходный паттерн разрушается.
Другие разработчики используют похожие приёмы:
- Эрик Хьюз за 15 минут собрал утилиту на основе Claude, которая удаляет невидимые символы, переставляет предложения и подставляет синонимы.
- Леон Хлон предложил сжимать ответ, переводить его на один из диалектов арабского и потом обратно — такой «переводческий пинг-понг» тоже сбивает маркировку.
Эти методы работают потому, что водяной знак находится в точном выборе слов. Любое серьёзное переписывание разрушает паттерн.
Почему обходят и что мешает считать это нарушением
Мотивация у разработчиков разная. Кто-то принципиально не согласен с тем, что каждый сгенерированный текст обязан иметь скрытую метку. Кто-то просто хочет проверить собственные навыки. А фрилансеры и контент-мейкеры обращаются к авторам обходных методов напрямую — им не нужны лишние ограничения при работе с черновиками. При этом юридически независимые инструменты находятся вне зоны действия запретов: новые правила ЕС грозят штрафами до 3% оборота провайдерам, которые продают средства обхода, но не ограничивают энтузиастов.
Уэйн Пан из компании Haimaker считает, что пока нельзя полностью доверять ни одному способу, пока не вышел официальный детектор от Anthropic. Но он интегрировал инструмент Мейера в свою платформу, полагаясь на понимание работы SynthID. Сам Мейер отмечает, что водяные знаки — плохое решение из-за риска ложных срабатываний и невозможности отличить лёгкое редактирование с помощью ИИ от полностью сгенерированного текста. Он признаётся, что регулярно использует Claude и Grammarly для обработки своих текстов.
Что говорят в Anthropic и чего ждать дальше
Представители компании подтверждают: маркировка не влияет на смысл и читаемость, а добавляется только для соответствия закону ЕС. Они работают над сервисом обнаружения и планируют выпустить API, чтобы разработчики могли проверять тексты. При этом в Anthropic признают, что после сильного редактирования, перефразирования или перевода водяной знак может исчезнуть. Система маркировки продолжает совершенствоваться, поэтому можно ожидать, что через какое-то время обходные методы станут менее эффективными.

Пока же ситуация выглядит как классическая гонка: Anthropic усиливает маркировку, а сообщество программистов отвечает новыми методами. Для пользователей это значит только одно — полностью скрыть использование ИИ пока проще, чем кажется, но и официальные способы проверки будут развиваться.



