В окружном суде Южного округа Нью-Йорка рассматривается иск The New York Times к OpenAI, в котором издание обвиняет разработчика ChatGPT в нелицензированном использовании своих материалов для обучения языковых моделей. Администрация президента США Дональда Трампа представила в этом деле 20-страничный документ, в котором поддержала позицию OpenAI. В документе говорится, что «Соединенные Штаты имеют сильную заинтересованность в продолжении развития robust и конкурентоспособной индустрии искусственного интеллекта, которая задает стандарты практики и процедуры использования ИИ в глобальном масштабе», и что для страны критически важно «сохранить глобальное лидерство в области искусственного интеллекта».
Суть спора сводится к вопросу, можно ли использовать защищенные авторским правом тексты для обучения больших языковых моделей без разрешения правообладателей. LLM, лежащие в основе ChatGPT, Claude и Gemini, обучаются на огромных массивах опубликованных произведений, включая книги, статьи и другие медиа. Издатели, в том числе The New York Times, утверждают, что такая практика незаконна. Ключевое понятие здесь — fair use (добросовестное использование), исключение в авторском праве, которое допускает использование чужих произведений без разрешения в определенных случаях. Суд должен решить, является ли использование материалов для обучения ИИ «трансформативным» — то есть создающим нечто новое, а не просто копирующим оригинал.
В документе администрации Трампа утверждается, что «ограничение разработки LLM на основе неверного понимания доктрины fair use помешало бы такому творческому и научному прогрессу, а также навредило бы американскому процветанию и экономической мобильности». Это не решение суда, но подобное вмешательство исполнительной власти может повлиять на ход разбирательства, хотя авторы документа не имеют юрисдикции в данном деле.
В документе утверждается, что ограничение обучения ИИ из-за fair use навредит лидерству США в области ИИ.

Показателен недавний случай с Anthropic, разработчиком модели Claude. В прошлом году судья Уильям Алсуп обязал компанию выплатить $1,5 млрд группе писателей, чьи произведения использовались для обучения. Однако штраф был наложен не за само обучение, а за использование нелегальных теневых библиотек для получения книг. В решении судья сравнил обучение LLM с чтением книг человеком: «Как и любой читатель, стремящийся стать писателем, LLM Anthropic обучались на произведениях не для того, чтобы обогнать или заменить их, а для того, чтобы создать нечто иное». Эта логика может стать прецедентом в трактовке fair use.
Пока судебная практика по делам об обучении ИИ складывается в пользу компаний-разработчиков, но окончательного вердикта по существу вопроса нет. Позиция администрации Трампа усиливает аргументы OpenAI, однако исход дела остается неопределенным. Для индустрии это означает, что вопрос об авторских правах на обучающие данные будет оставаться одним из ключевых рисков для бизнеса ИИ.



