Anthropic встроила в текст Claude невидимый водяной знак
С 2 августа 2026 года новые модели Claude метят весь сгенерированный текст скрытым водяным знаком — того требует подписанный Anthropic кодекс ЕС о прозрачности ИИ-контента. Метка не видна читателю и не меняет ответ модели, но уже через сутки после публикации подробностей на GitHub появился инструмент, который обещает её снимать.
Anthropic объяснила, как работает водяной знак, который новые модели Claude теперь оставляют в каждом сгенерированном тексте. Метка вводится не как символ или скрытые метаданные, а как статистический сдвиг в самих словах — и введена она не по собственной инициативе компании, а в рамках подписанного в июле 2026 года кодекса ЕС о прозрачности ИИ-контента (Code of Practice on Transparency of AI-Generated Content), который реализует статью 50 европейского AI Act.
Как работает метка
Там, где модель выбирает между несколькими равноценными формулировками, решение принимает не случайность, а комбинация секретного ключа и нескольких предыдущих слов. По утверждению Anthropic, в тексте не появляется ни одного лишнего символа или токена, различить помеченный и обычный ответ на глаз нельзя, а сама метка не содержит данных о конкретном пользователе, организации или переписке — обнаружить её может только тот, у кого есть ключ. Правило действует глобально, без региональных исключений: у Anthropic пока нет надёжного способа ограничить метку только пользователями из ЕС.
На новые модели, выпущенные после 2 августа 2026 года, знак ставится сразу. Более старые версии Claude получат поддержку постепенно, в переходный период, предусмотренный законом. Компания также предупреждает о пределе метода: лёгкая правка текста метку, скорее всего, не уберёт, а вот полная переработка каждого слова — уберёт.
Что это значит на практике
Для обычного диалога с Claude ничего не меняется — ни скорость, ни качество ответа, ни интерфейс. Метка адресована не собеседнику модели, а третьей стороне: изданию, вузу или платформе, которые хотят проверить, писал ли текст человек или ИИ. Для российских пользователей Claude исключений нет — правило применяется ко всем, независимо от страны обращения.
Быстрый отклик опенсорс-сообщества показывает и слабое место конструкции: инструмент watermarks-remover обещает чистить метки сразу нескольких поставщиков, комбинируя удаление служебных символов с переписыванием текста моделью. Но Anthropic не опубликовала ни публичный детектор метки, ни её техническую спецификацию — а значит, никто, включая авторов инструмента, пока не может доказать, что переписанный текст действительно перестаёт определяться как ответ Claude. Практический вывод один: считать невидимый знак стопроцентной защитой от выдачи ИИ-текста за собственный, как и полагаться на то, что он снят — сегодня одинаково преждевременно.
Возможности и тарифы самой модели — в карточке Claude.
Источник: Anthropic
Упомянутые инструменты
Не пропускать важное
Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.




Комментарий опубликован.