Anthropic объявила о планах встраивать невидимые водяные знаки в текст и изображения, создаваемые моделями Claude. Это часть подготовки к выполнению требований Европейского закона об искусственном интеллекте (EU ИИ Act), который вступил в силу 2 августа. Компания разместила на странице поддержки Claude описание будущих изменений: сгенерированный текст будет содержать встроенные водяные знаки, а файлы — цифровые метаданные о происхождении там, где это поддерживается.

Маркировка будет невидимой для человеческого глаза, но позволит людям и онлайн-платформам легче определять, был ли контент создан моделями Claude. Эти обновления — обязательство на будущее, а не немедленное изменение. EU ИИ Act предусматривает четырехмесячный льготный период для существующих ИИ-продуктов, запущенных до 2 августа. Поэтому новые модели Claude будут маркировать контент с первого дня после выпуска, а поддержка существующих моделей — в процессе разработки.

Технически маркировка будет применяться глобально ко всем поддерживаемым продуктам Claude: Claude Platform (API), Claude, Claude Code, Claude Cowork и Claude Tag. Для изображений, обработанных Claude, будет использоваться стандарт C2PA — формат метаданных о происхождении, который уже применяют Adobe, OpenAI и Google. Для текста Anthropic описывает «незаметный водяной знак», вплетаемый непосредственно в текст без изменения смысла, качества или читаемости ответа. Название системы не раскрывается, но известно, что водяные знаки будут применяться и при доступе к Claude через AWS, Google Cloud или Microsoft Foundry.

Новые модели Claude будут маркироваться с первого дня, существующие — позже; глобально для всех продуктов, включая API и Claude Code.

STKB364_CLAUDE_A
STKB364_CLAUDE_A · Источник: The Verge AI

Ключевая особенность текстовых водяных знаков — их устойчивость. По словам Anthropic, знак является частью текста, поэтому он сохраняется при копировании и вставке, а также может пережить некоторое редактирование. Маркировка будет применяться на уровне модели, то есть будет присутствовать независимо от того, через какой продукт или интерфейс генерируется текст.

Anthropic также работает над инструментами для обнаружения водяных знаков и метаданных, встроенных в контент Claude. Детали появятся в технической документации. Уже существуют инструменты для обнаружения C2PA, например, чат-бот Google Gemini, но неизвестно, будут ли они работать с файлами Claude.

Это шаг к четкой маркировке ИИ-контента на онлайн-платформах, что может быть полезно для тех, кто хочет избегать потребления такого контента. Например, читатели фанфиков уже создают примитивные системы для выявления использования Claude в работах на AO3, но новые системы могут применяться гораздо шире — если они будут работать.

Стоит отметить, что C2PA-данные легко удаляются, иногда случайно, при загрузке медиа на платформы. Надежность текстовых водяных знаков Anthropic пока неясна. Сама компания признает, что системы маркировки далеки от совершенства: контент без обнаружимых меток все равно может быть создан генеративными моделями.