Содержание
Как будет работать невидимая маркировка текстов Claude
Anthropic сообщила, что будущие модели Claude будут создавать текст со скрытым статистическим водяным знаком. Компания использует вариант технологии SynthID-Text и намерена включить маркировку глобально, чтобы выполнить требования европейского AI Act. Увидеть знак глазами или найти в тексте скрытые символы нельзя: он возникает из последовательности вариантов слов, выбранных моделью. API для его обнаружения уже существует, но находится в закрытом превью и недоступен широкой публике.
Что именно меняется в тексте
Языковая модель на каждом шаге выбирает следующий токен из нескольких допустимых вариантов. Когда два или больше продолжений примерно равноценны, система водяных знаков меняет источник случайности: выбор зависит от секретного ключа и нескольких предыдущих слов. В длинном тексте такая последовательность образует статистический паттерн, по которому владелец ключа может оценить вероятность участия Claude.
По заявлению Anthropic, водяной знак не добавляет служебные знаки, невидимые Unicode-символы или дополнительные токены. Он также не содержит идентификатора пользователя, организации, аккаунта или диалога. Компания утверждает, что в её внутренних тестах маркировка не повлияла на содержание, креативность и читаемость ответов. В качестве технической основы выбрана методика SynthID от Google DeepMind, ранее описанная для текста в научной публикации.
Anthropic не ожидает заметного влияния на скорость генерации и цену: для маркировки не нужны дополнительные выходные токены. Она будет применяться к тексту, который модель формирует сама, включая переводы.
Где детектор ошибается и что он доказывает
Результат проверки не является доказательством авторства. Детектор отвечает только на вопрос, насколько вероятно, что Claude участвовал в создании части текста. Он не различает полностью сгенерированный материал и документ, который модель существенно переписала, и не может определить работу другого AI-провайдера с отдельным ключом или иной системой маркировки.
Надёжность зависит от объёма текста и свободы выбора слов. В коротком фрагменте статистических сигналов мало. В фактическом ответе, математике или коде многие токены однозначно заданы правильностью, поэтому системе почти нечего менять. При лёгкой корректуре человеческого текста водяной знак может оказаться слишком слабым, а полная переформулировка способна его удалить.
Для файлов поддерживаемых типов Anthropic планирует другой механизм — C2PA Content Credentials. В PNG, JPEG и SVG будет добавляться криптографически подписанная запись в метаданных о создании или обработке файла Claude. Это не тот же статистический водяной знак: содержимое файла не меняется, а метаданные можно прочитать совместимым инструментом.
Доступность и связь с европейским регулированием
Anthropic объясняет изменение требованиями AI Act и Кодекса практики ЕС по прозрачности AI-контента, который компания подписала вместе с другими разработчиками. Маркировку будущих моделей планируют запускать по всему миру, поскольку устойчивого регионального разделения пока нет. Для моделей, выпущенных до 2 августа 2026 года, действует переходный период; Anthropic намерена добавлять маркировку в течение следующих месяцев.
Точная дата включения водяных знаков для каждой модели не названа. Доступ к detection API сейчас получают только отдельные организации, которым проверка нужна по европейскому законодательству: регуляторы, правоохранительные органы, СМИ, фактчекеры, независимые исследователи, образовательные учреждения и группы гражданского общества ЕС. Кроме них в превью могут участвовать предприятия с аналогичными обязанностями по проверке маркировки.
Публичного детектора для текста Claude пока нет, а наличие закрытого API не делает любой результат машинной проверки безошибочным. Anthropic говорит, что намерена расширять доступ со временем, но не публикует сроки. Полное техническое объяснение, перечень ограничений и актуальный статус API приведены в официальном материале Anthropic о водяных знаках Claude.
Коротко о водяных знаках Claude
Можно ли увидеть водяной знак в тексте Claude?
Нет. Это статистический паттерн в выборе слов, а не скрытые символы или видимая метка.
Доступен ли API проверки всем пользователям?
Нет. Detection API находится в закрытом превью для отдельных организаций и предприятий с обязанностями по проверке AI-маркировки.
Может ли детектор точно доказать авторство Claude?
Нет. Он оценивает вероятность участия Claude, хуже работает на коротком, фактическом и отредактированном тексте и не определяет другие AI-системы.
Содержит ли метка данные пользователя?
По данным Anthropic, водяной знак не несёт идентификаторов пользователя, организации, аккаунта или диалога.