Anthropic в пятницу, 17 августа, сообщила, что система маркировки текстов, генерируемых Claude, основана на открытой технологии SynthID-Text, разработанной Google DeepMind. Это решение принято для выполнения требований Европейского закона об ИИ, который обязывает компании помечать синтетический контент — аудио, изображения, видео и текст — машиночитаемыми метками, позволяющими определить, что он создан искусственным интеллектом.

Технология SynthID-Text работает за счет использования вероятностных закономерностей при выборе слов. Например, в предложении «Погода сегодня была холодной и…» слово «сахаристый» крайне маловероятно, тогда как «облачно» или «серо» — вполне возможные варианты. В таких случаях выбор слова не влияет на смысл, и он определяется случайным числом. Водяной знак использует подобные «низкорисковые» выборы, которые встречаются в тексте многократно, чтобы оставить незаметный для читателя паттерн. Этот паттерн можно обнаружить с помощью специального ключа, который меняет источник случайности: вместо произвольного генератора чисел используется ключ и несколько предыдущих слов.

Anthropic подчеркивает, что внедрение водяных знаков не приведет к удорожанию Claude и не окажет «никакого практического влияния на качество или содержание ответов». Компания также отмечает, что требования ЕС распространяются на всех крупных разработчиков ИИ, поэтому Claude не станет единственной моделью с текстовыми водяными знаками. Google уже использует SynthID-Text в чат-боте Gemini с 2024 года, а OpenAI, хотя и не раскрыла планы по маркировке текстов ChatGPT в своей дорожной карте соответствия ИИ Act, также будет обязана соблюдать эти правила.

Функция маркировки текста и поддержка C2PA для изображений вводятся для соответствия требованиям Европейского закона об ИИ.

STKB364_CLAUDE_2_C_96d15c
STKB364_CLAUDE_2_C_96d15c · Источник: The Verge AI

Помимо текстовых водяных знаков, Anthropic внедряет поддержку C2PA для изображений, обработанных Claude. C2PA — это открытый стандарт для проверки происхождения контента, который позволяет добавлять метаданные о создании и изменении файлов. Это дополняет меры по обеспечению прозрачности происхождения синтетического контента.

Для пользователей это означает, что тексты, созданные Claude, будут содержать невидимые метки, которые не влияют на восприятие, но позволяют проверять их происхождение. Для бизнеса, использующего ИИ в коммерческих целях, это может стать важным инструментом для соблюдения нормативных требований и повышения доверия к контенту.