Политика
Пять издателей подают в суд на Meta из-за Llama: эскалация войны за авторские права на ИИ
Hachette, Macmillan и три других крупных издателя присоединились к автору Скотту Тьюроу в суде против Meta за якобы пиратское использование миллионов книг для обучения Llama — и утверждают, что модель может воспроизводить тексты дословно.
Майкл С ·

Пять крупнейших в мире издательств — Hachette, Macmillan и ещё три — подали иск о нарушении авторских прав против Meta, утверждая, что компания незаконно использовала миллионы книг, от учебников до романов, для обучения своей модели Llama family of AI models. В иске, среди истцов по которому также указан автор бестселлеров Скотт Тьюро, утверждается, что Llama может дословно воспроизводить оригинальные произведения. Это служит прямым доказательством запоминания, которое истцам по делам об авторском праве прежде было трудно продемонстрировать в спорах об обучении ИИ.
Иск утверждает, что Llama может создавать точные копии оригинальных произведений — ключевой юридический порог, который предыдущие дела о нарушении авторских прав с участием ИИ пытались доказать.
Судебная подача, май 2026
Юридическая теория
Иск представляет собой значительное обострение продолжающейся судебной борьбы по поводу данных для обучения ИИ. Предыдущие дела о нарушении авторских прав против компаний, занимающихся ИИ, в основном сосредоточивались на самом акте обучения — утверждая, что использование защищённых авторским правом произведений без разрешения является нарушением, независимо от того, что модель впоследствии создаёт. Иск к Meta идёт дальше, утверждая не только то, что данные для обучения были получены путём пиратства, но и что результатирующая модель может воспроизводить оригинальные произведения в форме, которая напрямую заменяет оригинал.
Этот двухэтапный подход имеет юридическое значение. Претензия о дословном воспроизведении, если она будет доказана, подорвет одну из самых распространенных защит в индустрии ИИ: что обучение на защищенных авторским правом данных является трансформативным использованием, потому что модель изучает закономерности и связи, а не запоминает конкретный контент. Доказательства того, что Llama может дословно воспроизводить фрагменты, указывают на неполноту преобразования: по сути, модель сохранила копии оригинальных произведений в своих весах.
Вопрос о тренировочных данных
Исковые требования о практиках использования учебных данных Meta, вероятно, привлекут значительное внимание со стороны широкой индустрии ИИ. Meta была менее прозрачной, чем некоторые конкуренты, относительно состава учебных данных Llama, и утверждение истцов о том, что компания получила учебные материалы через пиратство — а не используя лицензированные наборы данных или веб-краулинг — если будет доказано, представляет собой более серьезный юридический риск, чем аргументы о честном использовании учебных данных, которые доминировали в предыдущих делах.
Последствия для отрасли
Для всей индустрии ИИ иск против Meta является напоминанием о том, что вопрос происхождения обучающих данных не решён — и что решение этой проблемы, когда оно наступит, может быть дорогостоящим. Компании, которые создавали большие языковые модели на данных, полученных из открытой сети, с сайтов пиратских копий книг или из других источников с неопределённым юридическим статусом, сталкиваются с потенциальной ответственностью, которая может превысить стоимость законной лицензии на эти данные с самого начала.
Meta еще не дала публичного ответа на иск. Ранее компания утверждала, что обучение моделей ИИ на общедоступных данных является допустимым использованием в соответствии с законодательством США об авторском праве — позиция, которую суды пока не приняли окончательно ни в подтверждение, ни в опровержение. Результат этого дела, а также нескольких других, рассматриваемых в судах, будет определять правовую основу, в рамках которой будет строиться следующее поколение моделей ИИ.