Судебный процесс The New York Times против OpenAI и Microsoft перешёл в новую фазу: рассекреченные документы объёмом 92 страницы содержат внутреннюю переписку и служебные записки, которые компании явно не готовили к публикации. В них топ-менеджеры и сотрудники обеих организаций прямо описывают, как обучение больших языковых моделей подрывает экономику издателей и сам открытый веб.

Центральная фигура в этих цитатах — директор по прикладной науке Microsoft Брент Хехт. Он называет сбор данных для ChatGPT и Copilot «крупнейшей кражей труда в истории человечества», а юридическую защиту Microsoft — «полным издевательством над идеей добросовестного использования». Отдельный внутренний документ Microsoft фиксирует, что ИИ-стратегия компании запустила «петлю гибели», которая навредит и моделям, и всему интернету: «крайне необычно, когда конечный продукт угрожает экономическим основам своих ключевых поставщиков, но именно такую ситуацию мы создали для нашего LLM-бизнеса в отношении его цепочки поставок контента». Microsoft уже дистанцировалась от этих слов: представитель компании Алекс Хаурек заявил The Verge, что комментарии отражают «частную позицию одного сотрудника», не являются юридическим анализом и не выражают взгляды корпорации. В отдельном документе Джордан Усдан, генеральный менеджер по стратегии данных в Microsoft ИИ, назвал роль Хехта «оппозиционной» и подчеркнул, что тот не уполномочен говорить от имени компании.

УчастникЦитата или позицияКонтекст
Брент Хехт, Microsoft«крупнейшая кража труда в истории человечества»О сборе данных для ChatGPT и Copilot
Внутренний документ Microsoft«петля гибели», вредящая моделям и вебуО ИИ-стратегии и цепочке поставок контента
Сатья Наделла, Microsoftчат-боты заменили поискО смене поведения пользователей
Ник Тёрли, OpenAI«нет веской причины кликать» по ссылкеО получении ответа от ChatGPT
Сотрудники OpenAIGPT-4 «чертовски хороша в воспроизведении»О дословном воспроизведении текстов
Эксперты OpenAIпадение поискового трафика до 60%О влиянии ИИ-сводок на издателей

Показания Сатьи Наделлы и Сэма Альтмана добавляют контекста. Наделла признаёт, что чат-боты фактически заменили поиск и устранили необходимость идти напрямую к источнику. При этом он же утверждал, что «всё, что находится за пейволом, должно лицензироваться», — однако представитель OpenAI признался, что не знает о каких-либо усилиях по обнаружению или удалению платного контента из обучающих данных. Внутренние документы OpenAI описывают ChatGPT как «современный газетный киоск», а руководитель направления ChatGPT Ник Тёрли прямо говорит: получив ответ от бота, у пользователя «нет веской причины кликать» по ссылке на источник.

Директор по прикладной науке Microsoft Брент Хехт назвал сбор данных для ChatGPT и Copilot «крупнейшей кражей труда в истории человечества».

STKS534_AI_DOOMSDAY2_B
STKS534_AI_DOOMSDAY2_B · Источник: The Verge AI

Особенно чувствительный пункт — воспроизведение защищённых авторским правом текстов. Сотрудники OpenAI признавали, что GPT-4 «запомнила массу данных и потому будет чертовски хороша в воспроизведении» фрагментов дословно. В иске приводятся примеры, когда ChatGPT выдавал длинные отрывки из статей The New York Times, Mercury News, The Denver Post, LifeHacker и Eurogamer в ответ на запросы. Внутренняя переписка также фиксирует, что «почти никто не предполагал, что созданный им контент будет использоваться таким образом, и никто за это не получает компенсации».

Экономические последствия уже измеримы. Собственные эксперты OpenAI по медиа и экономике связывают падение переходов на сайты издателей вроде The New York Times напрямую с ИИ-сводками, включая Google ИИ Overviews, и оценивают возможное снижение поискового трафика вплоть до 60%. Это укладывается в более широкую картину: издатели фиксируют сокращение реферального трафика с поиска, а регуляторы в разных юрисдикциях рассматривают иски о добросовестном использовании контента для обучения ИИ. Пока суд продолжается, документы уже дают представление о том, насколько осознанно компании шли на описанную ими же угрозу для открытого веба.