Anthropic начнёт маркировать ответы Claude: водяной знак не видно, но его можно проверить
Anthropic начнёт маркировать ответы Claude: водяной знак не видно, но его можно проверить
Anthropic объявила, что будущие модели Claude будут оставлять в сгенерированном тексте водяной знак. Читатель его не увидит: в ответ не добавляют скрытые символы или отдельные токены. Но тот, у кого есть ключ проверки, сможет оценить вероятность того, что Claude участвовал в создании текста.
Компания связывает запуск с требованиями EU AI Act к маркировке AI-контента. По её словам, на старте механизм включат глобально: пока нельзя надёжно ограничить его только пользователями из конкретного региона. Модели, выпущенные до 2 августа, Anthropic намерена подключать в ближайшие месяцы.
След остаётся в выборе слов
Claude, как и другие языковые модели, выбирает следующее слово из нескольких вероятных вариантов. В ситуациях, где допустимы разные формулировки без потери смысла, водяной знак меняет источник случайности этого выбора. За длинный текст накапливается паттерн, который можно проверить специальным ключом.
Anthropic использует вариант SynthID-Text — метода, опубликованного Google DeepMind в 2024 году. Компания утверждает, что внутренние тесты не выявили ухудшения качества, читабельности или творческого уровня ответов; дополнительной цены и заметного замедления тоже не будет.
Это не детектор авторства
Водяной знак не отвечает на вопрос «кто автор». Он может показать лишь то, что Claude, вероятно, участвовал в создании или существенной обработке материала. Он не распознаёт текст другого чат-бота и не содержит сведений о пользователе, организации или конкретном диалоге.
Есть и технические границы. Для коротких отрывков данных мало, в фактическом тексте и коде модель реже может выбирать между равнозначными вариантами, а лёгкая правка ослабляет сигнал. Полная перепись текста способна убрать его совсем.
Anthropic обещает отдельный API для проверки водяного знака. Для поддерживаемых файлов — например, PNG, JPG и SVG — Claude будет добавлять не такой знак, а криптографически подписанные метаданные C2PA. Для редакций, школ и компаний это полезнее привычных «AI-детекторов»: появится способ проверить происхождение части контента, но не универсальный судья человеческого авторства.













