10 августа Anthropic обновила справочную документацию: теперь все модели Claude, запущенные 2 августа 2026 года и позже, будут вплетать в сгенерированный текст невидимые водяные знаки. Маркировка происходит на уровне модели, поэтому она переживает копипаст, правки и не зависит от канала — чат, API, Claude Code или Cowork. К изображениям и файлам (.png,.jpg,.svg) будут добавляться метаданные по стандарту C2PA. Текущие модели пока не маркируются — для них предусмотрен переходный период без конкретных сроков.

Этот шаг связан с вступлением в силу статьи 50 европейского ИИ Act — части закона 2024 года, которая применяется со 2 августа 2026 года. Она требует от провайдеров генеративного ИИ, чтобы их выдача была помечена машиночитаемо и достоверно определялась как синтетическая. Деплойеры, в свою очередь, обязаны раскрывать дипфейки и сгенерированные тексты на общественно значимые темы. Под это Еврокомиссия выпустила кодекс практик из двух секций: для провайдеров и для деплойеров. Подписание кодекса добровольное, но обязательства по статье 50 — принудительные: за несоблюдение грозит штраф до €15 млн или 3% от глобального оборота.

КомпанияСтатус маркировкиДетектор
AnthropicНачнёт с моделей после 2 августа 2026Нет
OpenAIМаркирует изображения и аудио, текст — обещаетВерификатор для изображений и аудио
GoogleМаркирует текст Gemini с 2024Доступен избранным

К концу июля кодекс подписали около 190 организаций. В секции провайдеров — Google, Microsoft, OpenAI, Anthropic, Mistral и Meta (признана в России экстремистской организацией и запрещена). В секции деплойеров — Getty Images, Lufthansa, Bulgari, Lenovo, Iberdrola и десяток греческих новостных сайтов. Однако ни Google, ни Microsoft, ни Meta в секции деплойеров нет: гиганты согласились помечать контент, но не брать на себя обязательства показывать плашки на своих площадках. Китайских и российских компаний в списках нет, как и Apple, Amazon и SpaceX.

Статья 50 ИИ Act обязывает провайдеров маркировать ИИ-контент; штрафы до €15 млн или 3% оборота.

Парадокс регуляции в том, что ИИ-текст можно не помечать, если он прошёл человеческую редактуру и кто-то несёт за него ответственность. Логика такая: если юрист подписал заключение, он за него отвечает — неважно, чем он его создавал. Поэтому маркировка вводится не для борьбы с «ИИ-слопом», а для проверки, кто отвечает за текст. Google — пионер этой движухи, потому что его бизнес построен на поиске: ему нужно отличать сигнал от шума. Тысяча постов на Reddit от живых людей — сигнал, а тысяча сгенерированных — шум.

Настоящего детектора ИИ-текста нет ни у кого. Anthropic обещает «в будущей документации» рассказать, как проверять свои метки, но пока детектора от Claude нет. OpenAI запустила публичный верификатор с API — он ловит только картинки и аудио, текст ChatGPT пока не метит, но обещает начать. Google метит текст Gemini через SynthID с 2024 года, технология выложена в опенсорс, а детектор раздают лишь избранным медиа и исследователям. Сторонние детекторы вроде GPTZero работают недостоверно: они ищут в тексте тропы — длинные тире, частотные обороты, ритм — и на этом гадают. Например, свежая генерация Gemini в одном таком детекторе получила вердикт «создано человеком, уверенность 68%».

Вотермарки в тексте на глаз не определить. В видео Google про SynthID показано, что маркировка зашифровывается и считывается по принципу наличия определённых слов, а не специальных или невидимых символов. Поэтому просто удалить генерацию из текста не получится. Для ИИ-контента в X уже ввели автоматическую пометку «Made with ИИ», а в LinkedIn, где раньше была кнопка генерации ИИ-постов, теперь есть кнопка «Выглядит как ИИ-слоп».