Назад
17 августа 2026 г. в 19:58 AI Anthropic Claude EU AI Act AI Safety Content Provenance Anthropic

Anthropic начнёт маркировать ответы Claude: водяной знак не видно, но его можно проверить

Anthropic начнёт маркировать ответы Claude: водяной знак не видно, но его можно проверить

Anthropic начнёт маркировать ответы Claude: водяной знак не видно, но его можно проверить

Anthropic объявила, что будущие модели Claude будут оставлять в сгенерированном тексте водяной знак. Читатель его не увидит: в ответ не добавляют скрытые символы или отдельные токены. Но тот, у кого есть ключ проверки, сможет оценить вероятность того, что Claude участвовал в создании текста.

Компания связывает запуск с требованиями EU AI Act к маркировке AI-контента. По её словам, на старте механизм включат глобально: пока нельзя надёжно ограничить его только пользователями из конкретного региона. Модели, выпущенные до 2 августа, Anthropic намерена подключать в ближайшие месяцы.

След остаётся в выборе слов

Claude, как и другие языковые модели, выбирает следующее слово из нескольких вероятных вариантов. В ситуациях, где допустимы разные формулировки без потери смысла, водяной знак меняет источник случайности этого выбора. За длинный текст накапливается паттерн, который можно проверить специальным ключом.

Anthropic использует вариант SynthID-Text — метода, опубликованного Google DeepMind в 2024 году. Компания утверждает, что внутренние тесты не выявили ухудшения качества, читабельности или творческого уровня ответов; дополнительной цены и заметного замедления тоже не будет.

Это не детектор авторства

Водяной знак не отвечает на вопрос «кто автор». Он может показать лишь то, что Claude, вероятно, участвовал в создании или существенной обработке материала. Он не распознаёт текст другого чат-бота и не содержит сведений о пользователе, организации или конкретном диалоге.

Есть и технические границы. Для коротких отрывков данных мало, в фактическом тексте и коде модель реже может выбирать между равнозначными вариантами, а лёгкая правка ослабляет сигнал. Полная перепись текста способна убрать его совсем.

Anthropic обещает отдельный API для проверки водяного знака. Для поддерживаемых файлов — например, PNG, JPG и SVG — Claude будет добавлять не такой знак, а криптографически подписанные метаданные C2PA. Для редакций, школ и компаний это полезнее привычных «AI-детекторов»: появится способ проверить происхождение части контента, но не универсальный судья человеческого авторства.

Ещё новости

OpenClaw представил Enterprise для пилотов корпоративных ИИ-агентов
1 октября 2026 г.
OpenClaw представил Enterprise для пилотов корпоративных ИИ-агентов

OpenClaw открыл разработку Enterprise — платформы управления постоянными ИИ-агентами в корпоративной инфраструктуре. Проект пока предназначен для внутренних пилотов, но уже заявляет изоляцию задач, аудит и гибкую замену компонентов агента.

HydraFusion появился в VS Code и приложении GitHub Copilot
1 октября 2026 г.
HydraFusion появился в VS Code и приложении GitHub Copilot

GitHub расширил исследовательский предварительный доступ к HydraFusion: режим выбора нескольких моделей теперь доступен не только в Copilot CLI. Для команд это означает больше контроля над сложными задачами, но пока с условиями предварительного доступа.

IBM Bob разрешили запускать внутри закрытой инфраструктуры
1 октября 2026 г.
IBM Bob разрешили запускать внутри закрытой инфраструктуры

IBM добавила для своего агентного инструмента разработки Bob self-hosted-развёртывание. Компания позиционирует его для команд, которым нельзя отправлять код и контекст приложений во внешний облачный сервис.

Google показала Gemini 4 Argon, но пока не отдаёт её разработчикам
1 октября 2026 г.
Google показала Gemini 4 Argon, но пока не отдаёт её разработчикам

Google представила Gemini 4 Argon — новую флагманскую модель для программирования, корпоративных задач и киберзащиты. Но первый доступ получили только доверенные защитники в программе Fairwind: публичный API и приложение Gemini пока не открыты.

Airbnb добавляет ИИ-поиск: голосом, своими словами и с сравнением жилья
30 сентября 2026 г.
Airbnb добавляет ИИ-поиск: голосом, своими словами и с сравнением жилья

Airbnb запустила в США ИИ-инструменты для планирования поездки: поиск и фильтры обычным языком, краткие описания объявлений и сравнение сохранённых вариантов. Для европейских пользователей важная оговорка: в анонсе эти функции не обещаны, зато доставка еды и продуктов расширяется в Европе лишь в отдельных городах.

OpenAI Dots: агент в ChatGPT, которому дают работать между сообщениями
30 сентября 2026 г.
OpenAI Dots: агент в ChatGPT, которому дают работать между сообщениями

OpenAI представила Dots — платный агентный продукт внутри ChatGPT. Его идея не в одиночном ответе, а в непрерывной рабочей переписке, где задача может продолжаться в фоне.

OpenAI превращает ChatGPT в рабочую платформу для людей и агентов
29 сентября 2026 г.
OpenAI превращает ChatGPT в рабочую платформу для людей и агентов

На DevDay 2026 OpenAI описала ChatGPT как общую рабочую поверхность для людей, агентов и нативных приложений разработчиков. В самом recap нет условий доступа к отдельным продуктам, поэтому их нельзя считать доступными всем пользователям.

Grok 4.7 появилась в Amazon Bedrock: для Европы — только глобальный маршрут
29 сентября 2026 г.
Grok 4.7 появилась в Amazon Bedrock: для Европы — только глобальный маршрут

Amazon Bedrock добавил Grok 4.7 от xAI. Для европейских клиентов модель доступна лишь через глобальный межрегиональный профиль: это даёт доступ к 500-тысячному контексту, но не позволяет закрепить обработку в одной европейской зоне.

Anthropic выпустила Claude Sonnet 5.5 с киберзащитой уровня Opus
29 сентября 2026 г.
Anthropic выпустила Claude Sonnet 5.5 с киберзащитой уровня Opus

Anthropic представила Claude Sonnet 5.5 — более быструю и экономичную модель для повседневных агентных задач, кодинга и работы с документами. Компания заявляет заметный прирост на тестах, но оставляет Opus 5.5 выбором для сложной открытой работы.

Anthropic идёт к IPO с убытком $42 млрд и планом потратить $518 млрд на ИИ
29 сентября 2026 г.
Anthropic идёт к IPO с убытком $42 млрд и планом потратить $518 млрд на ИИ

Reuters ознакомилось с конфиденциальным проспектом Anthropic перед IPO: при выручке $4,6 млрд за 2025 год компания показала чистый убыток $42 млрд и описала план расходов на вычисления и инфраструктуру в $518 млрд на 2027 год. Большая часть убытка — бухгалтерская переоценка инструментов, связанных с будущими акциями; откуда возьмутся деньги на заявленный план, в материале не раскрывается.

Manus даёт личному ИИ-агенту почту, телефон и кошелёк
29 сентября 2026 г.
Manus даёт личному ИИ-агенту почту, телефон и кошелёк

Manus представила Manus 2.0 и приложение Cue, где персональному агенту обещают собственные email, телефон, кошелёк и компьютер. Для бизнеса это переносит главный вопрос от качества ответов к управлению учётными записями, деньгами и журналом действий.

NVIDIA открыла платформу безопасности для ИИ-агентов
28 сентября 2026 г.
NVIDIA открыла платформу безопасности для ИИ-агентов

NVIDIA представила Open Agent Safety Platform — набор открытых компонентов и эталонную архитектуру для контроля действий ИИ-агентов. Ключевая идея: критические ограничения должны проверяться вне самой модели.