Anthropic будет помечать контент, обработанный Claude, невидимыми водяными знаками
Компания готовит машинно-читаемые водяные знаки для контента, прошедшего через ее модели. Маркировка может появляться не только на сгенерированных текстах, но и на материалах, которые Claude лишь отредактировал
Один основной источник · Как мы проверяем новости

Что произошло
Anthropic раскрыла планы по внедрению машинно-читаемых водяных знаков для контента, который проходит через ее модели. В отличие от подхода, ограниченного полностью сгенерированными материалами, маркировка может затрагивать и контент, который модель только обработала.
Компания объясняет запуск требованиями EU AI Act. Закон требует от поставщиков AI-систем маркировать сгенерированные или измененные аудио, изображения, текст и видео.
Как будет работать маркировка
Anthropic заявила, что новые модели, предлагаемые глобально, будут помечать AI-контент «с первого дня». Текстовые результаты получат встроенные водяные знаки, невидимые для пользователя, а другие сгенерированные файлы, где это поддерживается, будут включать цифрово подписанные метаданные происхождения.
Для нетекстового контента компания планирует использовать подход C2PA. При этом Anthropic отмечает, что водяные знаки не будут работать на некоторых платформах или в функциях, которые их не поддерживают.
Что требует закон
EU AI Act применяется к AI-моделям, выпущенным после 2 августа, а для обновления ранее выпущенных моделей предусмотрен переходный период до декабря 2026 года.
При этом источник отмечает, что EU не требует такой маркировки в случаях, когда AI-система выполняет вспомогательную функцию стандартного редактирования, например исправляет грамматику, или не меняет существенно текст пользователя и его смысл.
Почему это важно
Главный спорный момент в том, что водяной знак на уровне модели не отличает полную генерацию от минимальной правки текста. Поэтому Claude может помечать материалы, которые закон, по оценке источника, не должен был затрагивать.
Anthropic также указывает, что обнаруженная метка не является окончательным доказательством: она лишь сигнализирует, что контент мог быть обработан Claude. При этом метка может появиться и на контенте, который Claude не генерировал.
Надежность системы пока нельзя проверить публично: насколько полно Claude будет наносить водяные знаки, станет ясно только после выпуска инструмента для их обнаружения.
Источники
Один основной источник. Как мы проверяем новости


