Водяной знак Claude в тексте: что он на самом деле доказывает
Anthropic добавит в тексты Claude скрытый водяной знак для проверки авторства. На качество ответов он не влияет, но и стопроцентной гарантии подлинности не даёт. Разбираемся, как устроена технология и какие у неё границы применения.
Anthropic начала вшивать в текст будущих версий Claude невидимую метку — что-то вроде цифрового клейма. Смысл простой: по этому клейму можно будет понять, писала ли конкретный кусок текста нейросеть компании. Появилась функция из-за требований ЕС, а на обычного читателя влиять не должна: по словам Anthropic, на ответы Claude AI она никак не сказывается. Подробности компания выложила отдельным постом на своём сайте.
Механика водяного знака
Во время генерации текста модель постоянно перебирает варианты: какое слово поставить следующим, если подходит сразу несколько. Обычно этот выбор случайный, буквально бросок кости. В версии с водяным знаком вместо случайного числа Claude берёт криптографический ключ, привязанный к уже написанному тексту.
Anthropic показывает это на примере фразы «The weather today was cold and…». Продолжить её можно словом overcast, можно словом grey — оба уместны, и именно такие развилки метка использует. Модель с водяным знаком смотрит на ключ и несколько предыдущих слов и по ним решает, какой из равноценных вариантов поставить. Детектор потом задаёт обратный вопрос: совпадает ли цепочка выборов в тексте с той, которую сделал бы Claude с этим ключом.
В итоге по всему ответу размазывается едва заметный статистический узор. Глазом его не различить, зато тот, у кого есть нужный ключ, посчитает вероятность того, что текст вышел из-под Claude. Логика здесь иная, чем у сторонних сервисов проверки на ИИ: они ищут стилистические приметы машинного письма, а тут работает встроенный сигнал с приватным ключом.
Скорость и цена не меняются
Anthropic заявляет, что на качестве ответов это никак не сказывается. Внутренние тесты не выявили ощутимой разницы в креативности, точности и читаемости между текстами с меткой и без неё; компания ссылается на исходную работу Google DeepMind, чей метод лёг в основу всей схемы.
Ещё один довод — статистика с реального трафика. При обкатке похожей технологии заметных изменений в удовлетворённости пользователей не зафиксировали. Метод не добавляет лишних токенов, так что чат-бот не станет ни медленнее, ни дороже.
Слабые места метода
Ограничения у водяного знака вполне реальные. Он работает только там, где у модели есть несколько равноценных продолжений. Если вариантов почти нет — жёсткие факты, точный код, задачи по математике — сигнал получается слабым, а то и вовсе исчезает.
На коротких фрагментах определение тоже ненадёжно: анализировать почти нечего, статистике не за что зацепиться. Чем длиннее текст, тем яснее картина. А поскольку метка следит только за словами, которые выбрал сам Claude, у текста, написанного человеком и лишь слегка отредактированного нейросетью, след может почти не остаться — основная часть формулировок ведь не менялась.
Серьёзная переработка стирает водяной знак целиком. Anthropic сама признаёт: в этой точке уже спорно, можно ли вообще называть результат сгенерированным ИИ.
Раскрывает ли метка личность пользователя
Нет. Anthropic отдельно подчёркивает: водяной знак не привязан к конкретному аккаунту, диалогу или человеку и не решает вопросы авторства или прав на контент. Максимум, что он показывает, — вероятность того, что Claude как-то поучаствовал в создании или правке текста.
Зачем это Anthropic
Дело не в доброй воле компании, а в регулировании. В июле 2026 года Anthropic подписала европейский Code of Practice on Transparency of AI-Generated Content вместе с примерно 190 другими компаниями. Это прямое следствие EU AI Act: закон вступает в силу 2 августа и обязывает поставщиков ИИ маркировать сгенерированный текст.
Включить водяной знак только для пользователей из ЕС технически пока не получается, поэтому функцию запускают сразу глобально. В ближайшие месяцы её обещают подтянуть и к более старым моделям Claude. Отдельно компания планирует открыть API: через него любой сможет проверить, есть ли в тексте метка Claude.
Смотрите также
-
Новости·Grok Bot: что это, как запустить и безопасно поручить ему работу
-
Новости·ИИ-слоп: что это такое и как его распознать
-
Новости·Ox Alpha: главная загадка не в том, кто его сделал
-
Игры·Pocket от Meta: мини-игры по промпту теперь доступны в США
-
Новости·Китайская модель Kimi K3 тоже сбежала из тестовой песочницы
-
Музыка·Suno добавит водяные знаки в ИИ-песни, чтобы их было проще отличить от настоящих
-
Ассистенты·Alexa+ с ИИ добралась до Австралии — и уже понимает местный сленг
-
Opensource·Moonshot AI открыла веса Kimi K3 — модели на 2,8 триллиона параметров против OpenAI и Anthropic
-
Новости·GPT-6 покажут Белому дому: Сэм Альтман летит в Вашингтон