Anthropic объявила о внедрении невидимых водяных знаков в тексты, сгенерированные Claude, чтобы соответствовать требованиям Европейского союза. Уже через четыре часа после этого заявления разработчик Гийом Мейер опубликовал код для удаления маркировки. Инструмент стал вирусным на GitHub, набрал более 20 000 закладок на X и привлек свыше 100 контрибьюторов, которые развивают проект.
Водяные знаки в Claude работают по технологии SynthID, разработанной Google. Она оставляет в выборе слов и фраз незаметный для человека паттерн, который может распознать специальное программное обеспечение. Anthropic использует эту технику для соблюдения EU ИИ Act, который обязывает провайдеров маркировать синтетический контент, чтобы его можно было детектировать машинным способом. За нарушение предусмотрены штрафы до 3% годового оборота компании. При этом правила запрещают провайдерам продвигать инструменты обхода, но не ограничивают независимых разработчиков.
Мейер, который является носителем французского языка и часто использует Claude для редактирования текстов, считает, что водяные знаки — плохое решение. Он указывает на риск ложных срабатываний: даже Anthropic признает, что может лишь оценить вероятность того, что текст был создан Claude. Это может привести к несправедливым отказам кандидатам при приеме на работу или ложным обвинениям исследователей в использовании ИИ. Мейер подчеркивает, что не против прозрачности, но считает, что водяные знаки имеют серьезные недостатки.
Разработчик Гийом Мейер создал инструмент для удаления водяных знаков, который стал вирусным на GitHub и X.
Метод Мейера основан на использовании другой большой языковой модели, которая не вставляет водяные знаки. Она генерирует несколько вариантов переписывания текста, заменяя слова синонимами и слегка реорганизуя контент. Это позволяет удалить паттерн, оставленный Claude. Другие разработчики предложили альтернативные подходы: инженер Эрик Хьюз создал инструмент за 15 минут, который удаляет невидимые символы и переставляет предложения, а Леон Хлон из Оксфордского университета предлагает переводить текст через арабский диалект и обратно. Anthropic признает, что сильно отредактированный или переведенный контент может не содержать водяной знак.
Пока нет полной уверенности, что инструмент Мейера работает, поскольку Anthropic не выпустила детектор водяных знаков. Однако Уэйн Пан, технический директор стартапа Haimaker, считает, что понимание SynthID-text делает метод рабочим. Он интегрировал инструмент в свою платформу, так как не согласен с невидимой маркировкой. В то же время 190 организаций, включая OpenAI, Microsoft и Meta, подписали кодекс практики ЕС по прозрачности, что может привести к повсеместному внедрению водяных знаков. Новые модели должны включать маркировку с августа, а существующие — до декабря.



