Главная страница Новости Переписать половину не поможет: водяной знак Claude переживет правку
Переписать половину не поможет: водяной знак Claude переживет правку

Переписать половину не поможет: водяной знак Claude переживет правку

Метка прячется в выборе между равнозначными словами и читается по ключу. Anthropic внедряет ее ради требований европейского AI Act.

Anthropic опубликовал разбор того, как будет работать водяной знак в текстах Claude. Пост вышел в пятницу и отвечает на вопросы, появившиеся после анонса в начале недели: как метка устроена, снимается ли правкой и что происходит с кодом. Водяные знаки компания вводит ради Transparency Code в рамках европейского AI Act — документ обязывает разработчиков давать возможность опознать сгенерированный контент.

Как работает метка. Когда модель делает малозначимый выбор — например, между «пасмурно» и «серо» для описания погоды, — она выстраивает в ответе закономерность. Читателю она не видна, но распознается тем, у кого есть ключ. Anthropic утверждает, что на качество текста это не влияет и помеченный ответ на глаз не отличается от обычного. В основе лежит подход SynthID-Text, описанный командой Google DeepMind в 2024 году. Компания собирается выпустить API для проверки.

Чем это отличается от детекторов. Сервисы вроде Pangram ищут в тексте характерные обороты, по которым узнают машинное письмо. Anthropic называет это принципиально другой задачей: детектор угадывает по стилю, а проверка водяного знака сверяет текст с ключом.

Снимается ли правкой. Компания отвечает прямо: снять метку можно, но легкая правка ее полностью не уберет. Уходит она при переписывании, где заменено каждое слово, — и тогда, замечает Anthropic, спорно, остается ли текст машинным. Если Claude только вычитывал чужой материал, наличие метки зависит от объема и глубины правок: при легкой вычитке почти все слова принадлежат автору, и знаку просто не за что зацепиться.

Что с кодом. В коде метки будет меньше: модель должна выдать рабочий результат и не может свободно выбирать между равнозначными вариантами. Там, где выбор произвольный, например в комментариях, водяной знак применяется, но на сам код влияет незначительно.

Реакция и оговорки. Пользователи спорят с момента анонса: на Reddit одни называют это заговором против пользователей Claude, другие отвечают, что возражать имеет смысл только тем, кто собирается врать. Business Insider пишет о десятках пользователей X, заявивших об отмене подписки. Вся механика описана самим Anthropic, независимых проверок устойчивости метки пока нет, API для детекции еще не вышел. Компания отмечает, что остальные крупные разработчики подписали тот же кодекс и внедрят собственные водяные знаки.

Awesome image

Схема «сгенерировать и слегка причесать» перестает быть невидимой. Anthropic говорит прямо: легкая правка метку не снимает, уходит она только при полной переписке с заменой каждого слова, а это уже не редактура, а написание заново. Для контентных сеток, обзорников и прелендов это значит, что скоро любой площадке хватит одного прогона текста через API проверки.

Что делать сейчас. Код и техническая обвязка метку почти не несут, так что здесь ничего не меняется. Ценность контента стоит пересобрать вокруг того, что не генерируется: свои скриншоты кабинетов, свои цифры по связкам, свои тесты. И следите не за фактом разметки, а за тем, кто подключит детекцию: сам по себе водяной знак не наказание, вопрос в том, начнут ли рекламные сети, маркетплейсы и поисковики использовать его при модерации. Пока об этом не объявлял никто.

Чо, как вам статья?

Материалы по теме

TechCrunch выпустил гайд по проверке аккаунтов ChatGPT, Claude и Perplexity
Где искать список активных сессий на трех популярных AI-сервисах и как выкинуть из аккаунта чужое устройство. У Perplexity такого списка просто нет.
Дружелюбный кейлоггер: ChatGPT теперь пишет все, что вы печатаете на Mac
OpenAI заменил скриншоты Chronicle на запись событий ввода. Сводки хранятся локально в открытом виде, компания сама предупреждает о риске prompt injection.
Google Ads уберет настройку языка из поисковых кампаний в сентябре
Настройка языка на уровне кампании исчезает из поиска Google Ads. Язык показа теперь задает только креатив и посадочная страница.

Вставить свои 5 копеек:

Awesome image
Awesome image
Awesome image Awesome image Awesome image Awesome image
Awesome image