Нейролюб
НовостьНейросетиAnthropicClaude

Anthropic добавит невидимые водяные знаки в тексты Claude — API проверки пока закрыт

Anthropic раскрыла, как будет маркировать тексты будущих моделей Claude по требованиям AI Act. Водяной знак на базе SynthID-Text не добавляет символы и персональные данные, но хуже определяется в коротких, factual и отредактированных фрагментах. API проверки доступен лишь в закрытом превью.

Кирилл Киреев

01.09.2026 · 5 минут чтения · Нейросети

Anthropic Claude Text Watermark Synthid Eu AI Act Cover

Содержание

Как будет работать невидимая маркировка текстов Claude

Anthropic сообщила, что будущие модели Claude будут создавать текст со скрытым статистическим водяным знаком. Компания использует вариант технологии SynthID-Text и намерена включить маркировку глобально, чтобы выполнить требования европейского AI Act. Увидеть знак глазами или найти в тексте скрытые символы нельзя: он возникает из последовательности вариантов слов, выбранных моделью. API для его обнаружения уже существует, но находится в закрытом превью и недоступен широкой публике.

Что именно меняется в тексте

Языковая модель на каждом шаге выбирает следующий токен из нескольких допустимых вариантов. Когда два или больше продолжений примерно равноценны, система водяных знаков меняет источник случайности: выбор зависит от секретного ключа и нескольких предыдущих слов. В длинном тексте такая последовательность образует статистический паттерн, по которому владелец ключа может оценить вероятность участия Claude.

По заявлению Anthropic, водяной знак не добавляет служебные знаки, невидимые Unicode-символы или дополнительные токены. Он также не содержит идентификатора пользователя, организации, аккаунта или диалога. Компания утверждает, что в её внутренних тестах маркировка не повлияла на содержание, креативность и читаемость ответов. В качестве технической основы выбрана методика SynthID от Google DeepMind, ранее описанная для текста в научной публикации.

Anthropic не ожидает заметного влияния на скорость генерации и цену: для маркировки не нужны дополнительные выходные токены. Она будет применяться к тексту, который модель формирует сама, включая переводы.

Где детектор ошибается и что он доказывает

Результат проверки не является доказательством авторства. Детектор отвечает только на вопрос, насколько вероятно, что Claude участвовал в создании части текста. Он не различает полностью сгенерированный материал и документ, который модель существенно переписала, и не может определить работу другого AI-провайдера с отдельным ключом или иной системой маркировки.

Надёжность зависит от объёма текста и свободы выбора слов. В коротком фрагменте статистических сигналов мало. В фактическом ответе, математике или коде многие токены однозначно заданы правильностью, поэтому системе почти нечего менять. При лёгкой корректуре человеческого текста водяной знак может оказаться слишком слабым, а полная переформулировка способна его удалить.

Для файлов поддерживаемых типов Anthropic планирует другой механизм — C2PA Content Credentials. В PNG, JPEG и SVG будет добавляться криптографически подписанная запись в метаданных о создании или обработке файла Claude. Это не тот же статистический водяной знак: содержимое файла не меняется, а метаданные можно прочитать совместимым инструментом.

Доступность и связь с европейским регулированием

Anthropic объясняет изменение требованиями AI Act и Кодекса практики ЕС по прозрачности AI-контента, который компания подписала вместе с другими разработчиками. Маркировку будущих моделей планируют запускать по всему миру, поскольку устойчивого регионального разделения пока нет. Для моделей, выпущенных до 2 августа 2026 года, действует переходный период; Anthropic намерена добавлять маркировку в течение следующих месяцев.

Точная дата включения водяных знаков для каждой модели не названа. Доступ к detection API сейчас получают только отдельные организации, которым проверка нужна по европейскому законодательству: регуляторы, правоохранительные органы, СМИ, фактчекеры, независимые исследователи, образовательные учреждения и группы гражданского общества ЕС. Кроме них в превью могут участвовать предприятия с аналогичными обязанностями по проверке маркировки.

Публичного детектора для текста Claude пока нет, а наличие закрытого API не делает любой результат машинной проверки безошибочным. Anthropic говорит, что намерена расширять доступ со временем, но не публикует сроки. Полное техническое объяснение, перечень ограничений и актуальный статус API приведены в официальном материале Anthropic о водяных знаках Claude.

Коротко о водяных знаках Claude

Можно ли увидеть водяной знак в тексте Claude?

Нет. Это статистический паттерн в выборе слов, а не скрытые символы или видимая метка.

Доступен ли API проверки всем пользователям?

Нет. Detection API находится в закрытом превью для отдельных организаций и предприятий с обязанностями по проверке AI-маркировки.

Может ли детектор точно доказать авторство Claude?

Нет. Он оценивает вероятность участия Claude, хуже работает на коротком, фактическом и отредактированном тексте и не определяет другие AI-системы.

Содержит ли метка данные пользователя?

По данным Anthropic, водяной знак не несёт идентификаторов пользователя, организации, аккаунта или диалога.