Anthropic объявила о внедрении машинно-читаемых водяных знаков для контента, обработанного моделями Claude. Согласно поддержке Anthropic, маркировка вводится для соответствия требованиям Европейского закона об искусственном интеллекте (EU ИИ Act), который обязывает провайдеров ИИ помечать сгенерированный или изменённый контент. Закон распространяется на модели, выпущенные после 2 августа, с переходным периодом до декабря 2026 года для ранее выпущенных моделей. Anthropic подтвердила, что все новые модели будут маркировать контент с первого дня, причём не только в ЕС, но и по всему миру.
Водяные знаки будут внедрены в текст, изображения, аудио и видео. Для текста это будет невидимая встроенная метка, а для других файлов — цифровые метаданные происхождения (C2PA). Однако подход Anthropic идёт дальше требований закона: маркировка будет применяться ко всему обработанному контенту, включая случаи, когда ИИ выполняет лишь вспомогательную функцию, например, исправление грамматики. Это может привести к тому, что водяной знак появится на тексте, который был лишь незначительно отредактирован, хотя закон явно освобождает такие случаи от маркировки.
Технически текстовая маркировка работает за счёт смещения выбора слов моделью в определённом паттерне, который можно обнаружить только агрегированно. Это означает, что модель иногда выбирает не самое подходящее слово ради сохранения сигнала. Anthropic отмечает, что метка сохраняется при копировании и вставке, но может быть уничтожена при редактировании текста другой ИИ-системой. Для изображений и видео достаточно скриншота или удаления метаданных, чтобы избавиться от маркировки.
Маркировка обязательна для новых моделей с августа 2025 года, для старых — до декабря 2026 года.

Кроме того, водяной знак не является доказательством того, что контент был сгенерирован ИИ. Он лишь указывает, что контент мог быть обработан Claude, и может появляться даже на тексте, не созданном моделью. Это создаёт риск ложных обвинений: например, преподаватель может ошибочно заподозрить студента в использовании ИИ, если тот просто воспользовался проверкой грамматики.
Anthropic признаёт, что маркировка может затрагивать контент, не подпадающий под требования закона, но считает это необходимым для соблюдения EU ИИ Act. Компания планирует предоставить инструменты для обнаружения меток, но пока не раскрывает деталей. Это означает, что проверить эффективность маркировки можно будет только после выпуска соответствующего инструмента.
В целом, подход Anthropic вызывает вопросы: с одной стороны, он направлен на соблюдение закона, с другой — может вводить в заблуждение пользователей и создавать ложные сигналы о происхождении контента. Учитывая лёгкость обхода маркировки, её практическая ценность для борьбы с дезинформацией остаётся под вопросом.



