Перейти к содержимому

Anthropic claude водяной знак и статья 50 Ai act: как работает скрытая маркировка

2 августа 2026 года совпало сразу с двумя событиями: в Евросоюзе начала реально работать статья 50 AI Act, а Anthropic объявила, что новые версии Claude с этого дня будут оставлять в каждом ответе скрытую маркировку. Не метаданные в "углу" и не дополнительную строку, а именно невидимое клеймо текста ИИ - встроенное в саму манеру выбора слов. Идея была подана как шаг к прозрачности: если уж рынок наводняют тексты от моделей, то у общества и регуляторов должен появиться способ отличать их от человеческих.

Эффект оказался предсказуемо взрывным. Уже примерно через 48 часов в GitHub начали разрастаться репозитории, обещающие "стереть" маркировку: один проект потянул за собой другие, обсуждения разошлись мемами, злостью и тревогой - от журналистов до преподавателей. Но почти сразу возникла неприятная для обеих сторон деталь: ни авторы этих утилит, ни сама Anthropic не смогли убедительно доказать, что хоть одно решение стабильно работает в реальном мире на разных стилях и длинах текста. Эта неопределённость - не промах PR и не "слив" технологии, а свойство самой идеи водяных знаков в тексте.

Своё решение Anthropic связала с добровольным Кодексом практики по прозрачности ИИ‑контента, который Еврокомиссия считает "адекватным" путём соответствия статье 50. Под новые правила попали свежие релизы, включая флагманский Opus 5 и более лёгкий Sonnet 5. В пользовательской документации компания разложила обязательства на четыре понятных пункта: новые модели маркируются с первого дня; маркировка применяется во всех продуктах, где доступен Claude (API/Claude Platform, приложения Claude, Claude Code, Claude Cowork, Claude Tag и т. д.); обещан отдельный инструмент обнаружения; а для моделей, выпущенных до 2 августа, предусмотрен переходный период.

Любопытно, что требование закона касается европейского контура, но Anthropic фактически сделала маркировку глобальной - и для США, и для Азии. Это выглядит благородно, но прагматика тоже очевидна: поддерживать две ветки - с меткой и без - дорого, сложно и рискованно для качества. Проще выпускать один продукт на весь мир. Именно поэтому Anthropic Claude водяной знак мгновенно превратился в тему номер один не только у юристов, но и у инженеров.

Главный вопрос звучит наивно, но справедливо: как вообще можно "спрятать" метку в тексте, где нет пикселей? Ответ лежит в том, как модель генерирует фразу. Claude не "печатает" слово за словом как машинистка; на каждом шаге он выбирает следующий токен из набора кандидатов с вероятностями. И вот в этом узком зазоре - между несколькими почти одинаково уместными вариантами - и живёт маркировка.

Механизм описывают как двухгрупповую схему с секретным ключом. Ключ, известный только Anthropic, каждый раз делит список кандидатов на две условные корзины - "зелёную" и "красную". Модель не запрещают использовать "красные" слова, ей лишь слегка занижают их шанс, мягко подталкивая к "зелёным". Один выбор ничего не доказывает, но на дистанции в сотни и тысячи слов накапливается статистическое смещение. Это похоже на подкрученный кубик: по двум броскам не поймёшь, а по тысяче - уже видно, что "шестёрка" выпадает подозрительно часто.

У маркировки от Anthropic заявлен "двухслойный" характер. Для обычного текста - именно скрытый сигнал на уровне генерации. Для файлов (например, .svg, .png, .jpg) компания использует подписанные метаданные по открытому стандарту C2PA - тому самому, который уже применяют в фотожурналистике, чтобы проверять происхождение и целостность изображения. Иными словами, если текст - это вероятностная "интонация" выбора слов, то для медиафайлов предусмотрена криптографически оформленная подпись.

Почему же тогда разговоры про "удалить водяной знак Claude" всплыли так быстро? Потому что текстовые водяные знаки в принципе уязвимы к простым преобразованиям: перефразированию, переводу туда‑обратно, агрессивному сокращению, "смешиванию стилей", замене редких слов на частотные. Вся эта зона и есть обход водяного знака AI текста: вы не ломаете ключ, вы размываете статистику так, чтобы смещение перестало уверенно считываться. Чем короче итоговый фрагмент и чем сильнее переписан, тем слабее сигнал - а значит, тем выше шанс, что любой детектор начнёт ошибаться.

Отсюда вытекает и второй конфликт: миру нужен детектор AI текста Claude, но детектор, который не ошибается, - почти недостижимая цель. Если сделать его "строгим", он пропустит массу реальных генераций после редактуры. Если сделать "чувствительным", он начнёт клеймить человеческие тексты - особенно короткие, шаблонные и написанные в канцелярите. Поэтому история быстро перешла из плоскости "взломали/не взломали" в плоскость вероятностей, порогов и юридических последствий ошибок.

Есть и ещё один слой - социальный. Когда в публичной дискуссии появляется "невидимая" метка, люди вспоминают не только нейросети, но и более древние способы маркировки: от водяных знаков на бумаге (вроде знаменитой фабрианской традиции из Фабриано) до типографских "отпечатков" наборов. И хотя технологии несопоставимы, логика та же: метка полезна, пока не начинает превращаться в инструмент обвинений без права на апелляцию.

Что всё это значит на практике? Вероятнее всего, скрытая маркировка станет не "детектором правды", а ещё одним сигналом в наборе доказательств - рядом с логами публикации, C2PA‑подписью для изображений, историей правок и контекстом появления текста. Для редакций, вузов и платформ это означает необходимость процедур: как трактовать найденную метку, что делать при спорном результате, можно ли требовать исходники, и кто отвечает за ложные срабатывания.

И наконец - вывод, который не любят ни энтузиасты, ни скептики: водяные знаки в тексте почти неизбежно будут гонкой вооружений. Модели научатся сохранять читаемость при маркировке, а пользователи - "смывать" сигнал редактурой. В этом смысле нынешняя волна проектов, обещающих мгновенный "анти‑вотермарк", - не сенсация, а ранняя иллюстрация того, как рынок адаптируется к правилам AI Act и к новым ожиданиям общества о прозрачности машинного контента.

Scroll to Top