Суд обязал Anthropic выплатить $1,5 млрд группе писателей, чьи произведения использовались для обучения ИИ-моделей компании. Однако ключевой момент решения судьи Уильяма Алсупа — признание самого обучения законным. Штраф был наложен не за использование книг как таковое, а за их получение из нелегальных онлайн-библиотек, так называемых «теневых библиотек». Это решение стало одним из первых прецедентов в США, проясняющих правовой статус обучения ИИ на защищённых авторским правом текстах.

Суть спора сводится к доктрине fair use («добросовестное использование») — исключению из авторского права, которое разрешает использование произведений без разрешения правообладателя в таких целях, как критика, комментарий, пародия или образование. Судьи оценивают четыре фактора: цель и характер использования, природу произведения, объём использованного материала и влияние на рынок оригинала. В деле Anthropic судья Алсуп сравнил обучение языковой модели с чтением литературы писателем: модель «поглощает» триллионы слов, чтобы создавать нечто новое, а не копировать исходные тексты. Это трактовка близка к позиции ИИ-компаний, которые утверждают, что обучение — это не копирование, а «чтение».

Однако не все суды придерживаются такого подхода. В другом громком деле Thomson Reuters против Ross Intelligence судья Стефанос Бибас постановил, что использование контента Reuters для обучения ИИ-платформы, которая напрямую конкурирует с Reuters, не является fair use. Ключевое различие — цель использования: если модель создаётся для конкуренции с правообладателем, суды склонны видеть нарушение. Пока авторы не смогли убедить суды, что чат-боты конкурируют с ними, создавая синтетические книги, но этот аргумент остаётся в арсенале истцов.

Ключевой вопрос — fair use: использование произведений должно быть «трансформативным» и не конкурировать с оригиналом.

Image Credits:NanoStockk (opens in a new window) / Getty Images
Image Credits:NanoStockk (opens in a new window) / Getty Images · Источник: TechCrunch AI

Правовая неопределённость усугубляется тем, что закон об авторском праве в США не обновлялся с 1976 года. Судьям приходится применять нормы полувековой давности к технологиям, которые тогда невозможно было представить. Как отмечает Джейсон Хендерсон, старший юрист и основатель IP & Media Practice в JWL International, «все очень обеспокоены, потому что закон разрознен, и это связано с этим вопросом». Юристы признают, что суды «мечутся» в своих решениях, но общая тенденция: обучение на чужих произведениях допустимо, если не создаёт прямого конкурента.

Эксперты, такие как адвокат Кэти Джеллис, считают, что решение по Anthropic в целом благоприятно для ИИ-индустрии. Штраф в $1,5 млрд — значительная сумма, но для компании с прогнозируемой выручкой около $200 млрд к 2028 году это скорее операционные издержки, чем экзистенциальная угроза. Джеллис подчёркивает, что авторское право «завязано на копировании, но не на использовании, прочтении или потреблении произведения». Это различие становится центральным в спорах.

Отдельный вопрос — защита авторских прав на контент, созданный самим ИИ. В деле Thaler v. Perlmutter суд постановил, что полностью сгенерированное ИИ произведение не подлежит авторскому праву. Это порождает новые сложности: как доказать, что текст создан человеком, и как определить долю участия ИИ? Пока ответов нет, и правовая база продолжает отставать от технологий.

Для авторов и издателей ситуация остаётся напряжённой: их произведения используются без согласия, а суды пока не дают однозначного ответа, нарушает ли это их права. Для ИИ-компаний главный риск — не сам факт обучения, а источники данных: использование пиратских библиотек может привести к многомиллиардным штрафам. В отрасли нарастает тренд на заключение лицензионных соглашений с правообладателями, например, сделки OpenAI с издательскими домами, но это лишь частично решает проблему.

Пока суды вырабатывают единый подход, разработчикам ИИ стоит внимательно следить за источниками обучающих данных и избегать заведомо нелегальных архивов. Авторам же остаётся надеяться, что будущие решения уточнят границы fair use и защитят их интересы. Правовая неопределённость, вероятно, сохранится до тех пор, пока законодатели не обновят закон об авторском праве с учётом реалий ИИ.