Anthropic подписала Кодекс практики ЕС по прозрачности ИИ-контента. Согласно документу, новые модели Claude, выпущенные на рынок ЕС 2 августа 2026 года или позже, будут включать встроенные водяные знаки в тексте и подписанные метаданные происхождения для файлов. Требование распространяется глобально на все продукты Claude: API, Claude, Claude Code, Claude Cowork и Claude Tag. Существующие модели получат переходный период, но Anthropic уже работает над их адаптацией.
Технически маркировка реализуется двумя способами. Текст, сгенерированный Claude, будет содержать невидимый водяной знак, который не влияет на смысл, качество или читаемость. Он наносится на уровне модели, поэтому не зависит от конкретного продукта. Знак устойчив к копированию и вставке и, по словам компании, «может сохраняться после некоторого редактирования». Для файлов, включая.svg,.png и.jpg, будет использоваться открытый стандарт C2PA, разработанный Коалицией за происхождение и подлинность контента. Подпись указывает, что файл обработан Claude, и позволяет обнаружить последующие изменения.
Anthropic признает ограничения технологии. Обнаруженный водяной знак не означает, что текст написан именно Claude: пользователи часто применяют модель для проверки, перевода или суммаризации, и в таких случаях знак может присутствовать, хотя идеи принадлежат человеку. Отсутствие знака также не доказывает обратное: модель могла быть выпущена до внедрения маркировки, текст мог быть сильно отредактирован или переведен, либо метаданные удалены при конвертации формата или скриншоте. Ключевой вопрос — насколько водяные знаки переживут редактирование, переформатирование и перевод. Если они окажутся устойчивыми, проверка станет надежнее, чем у проприетарных детекторов вроде Pangram, чьи методы не раскрывают причину срабатывания.
С августа 2026 года новые модели Claude будут иметь встроенные водяные знаки и подписанные метаданные.
Anthropic не одинока в этом направлении. Google DeepMind открыла исходный код своей системы SynthID, встроенной в Gemini. SynthID слегка изменяет вероятности токенов при генерации, создавая водяной знак без ухудшения качества текста. Он работает на разных языках, но плохо справляется с редактированным текстом. OpenAI, в свою очередь, уже около двух лет держит готовый детектор текста с точностью 99,9%, но не выпускает его, опасаясь обхода через перевод или переписывание, стигматизации групп пользователей и возможного ущерба собственному бизнесу.
Особенно остро проблема стоит в образовании, где ненадежные детекторы могут приводить к ложным обвинениям в списывании. Исследования показывают, что чрезмерное использование ИИ ослабляет критическое мышление и навыки письма, особенно у студентов, воспринимающих инструменты как замену обучению. Мошенники уже используют ИИ для прохождения курсов и получения финансовой помощи в американских колледжах. Для Anthropic это может иметь бизнес-последствия: Claude популярен среди студентов из-за естественного языка, и более надежная детекция может снизить привлекательность модели в академической среде.



