Anthropic, разработчик моделей семейства Claude, объявила о внедрении водяных знаков для текстов, генерируемых ее ИИ-системами. Решение принято в связи с вступлением в силу Transparency Code, части EU ИИ Act, который с 2 августа требует от компаний маркировать контент, созданный или измененный искусственным интеллектом, таким образом, чтобы другие системы могли его идентифицировать. Обновленная страница поддержки Anthropic раскрывает детали технической реализации.

Согласно опубликованной информации, все модели, выпущенные после 2 августа, будут автоматически включать механизм маркировки как для текста, так и для файлов. Для файлов компания использует открытый стандарт C2PA (Coalition for Content Provenance and Authenticity), который уже применяется в фото- и видеоконтенте для подтверждения происхождения. Водяной знак встраивается непосредственно в текст, поэтому он сохраняется при копировании и вставке, а также может пережить некоторые правки. Маркировка применяется на уровне модели, что означает ее наличие во всех продуктах Anthropic, включая Claude API, Claude, Claude Code, Claude Cowork и Claude Tag.

Компания также пообещала распространить поддержку маркировки на более старые модели, однако точные сроки и методы пока не раскрыты. Остается неясным, насколько интенсивное редактирование потребуется пользователю, чтобы удалить водяной знак. Представители Anthropic не ответили на запрос TechCrunch о разъяснениях, но пообещали обновить информацию.

Маркировка применяется ко всем моделям, выпущенным после 2 августа, и распространяется на старые модели.

Image Credits:Samuel Boivin/NurPhoto / Getty Images
Image Credits:Samuel Boivin/NurPhoto / Getty Images · Источник: TechCrunch AI

Решение Anthropic отражает общую тенденцию: платформы спешат маркировать ИИ-контент после критики со стороны пользователей и в ожидании регуляторных мер. На прошлой неделе музыкальная платформа Suno объявила о маркировке треков, созданных на ее сервисе, после серии судебных исков. В прошлом месяце сервис рассылок Substack начал сотрудничество с Pangram для выявления ИИ-сгенерированного контента, а его генеральный директор Крис Бест ввел термин «клодфишинг» для описания практики использования ИИ для создания контента.

Помимо Anthropic, обязательства по соблюдению кодекса ЕС взяли на себя Black Forest Labs, Google, Meta, Microsoft, OpenAI и Synthesia. Однако технические подходы к маркировке различаются: некоторые компании используют метаданные, другие — видимые или невидимые водяные знаки. Для текстовых моделей задача сложнее, чем для изображений или видео, поскольку текст легко редактировать, перефразировать или переводить, что может уничтожить маркер. Стандарт C2PA, применяемый Anthropic для файлов, основан на криптографической подписи и метаданных, но его эффективность для текста ограничена.

Для пользователей Claude маркировка означает, что сгенерированные тексты будут содержать скрытый идентификатор, который может быть обнаружен специализированными инструментами. Это важно для журналистов, исследователей и всех, кто работает с ИИ-контентом, поскольку позволяет проверять происхождение текста. Однако пока неясно, насколько устойчив водяной знак к перефразированию и другим видам редактирования, что может снизить его практическую ценность.

Внедрение маркировки — часть более широкого движения к прозрачности в ИИ-индустрии. EU ИИ Act устанавливает обязательные требования для систем ИИ, включая прозрачность и маркировку синтетического контента. Хотя полное применение закона ожидается в ближайшие годы, компании уже адаптируют свои продукты. Для Anthropic это также способ укрепить доверие пользователей и избежать регуляторных рисков, особенно в Европе, где законодательство в области ИИ наиболее строгое.

Вопрос о том, насколько эффективно водяные знаки будут выполнять свою функцию, остается открытым. Технология маркировки текста находится на ранней стадии, и ее надежность будет проверена на практике. Пока же Anthropic делает ставку на C2PA и встроенные метки, которые, по словам компании, будут присутствовать во всех текстах, созданных ее моделями, независимо от способа использования.