Законно ли обучать ИИ на защищённых авторским правом книгах? Однозначного ответа нет
Судебная практика в США по вопросу законности обучения ИИ-моделей на защищённых авторским правом произведениях остаётся противоречивой, поскольку устаревшее законодательство с трудом применяется к новым технологиям. Юристы отмечают, что исход дел часто зависит от того, конкурирует ли созданный продукт напрямую с рынком оригинального произведения.

Крупные чат-боты на основе ИИ, такие как ChatGPT, Gemini и Claude, обучаются на огромных массивах текстов — книгах, статьях и других материалах, зачастую без ведома и согласия авторов. Хотя это может показаться очевидно незаконным, юридическая реальность гораздо сложнее.
В прошлом году судья Уильям Алсап обязал компанию Anthropic выплатить 1,5 миллиарда долларов группе писателей, чьи произведения использовались для обучения ИИ-моделей. Однако принципиально важно, что сам процесс обучения судья признал законным — Anthropic оштрафовали именно за получение книг из нелегальных теневых библиотек, а не за факт обучения на них. Алсап сравнил то, как модель ИИ усваивает текст, с тем, как писатель изучает литературу, чтобы создать нечто новое, а не воспроизвести существующее.
Юрист Кэти Геллис считает, что это решение на самом деле выгодно компаниям, занимающимся ИИ, поскольку оно приравнивает обучение ИИ скорее к «чтению» произведения, чем к его «копированию», а закон об авторском праве строится именно вокруг копирования, а не простого использования или потребления произведения.
Устаревший закон, меняющаяся практика
Закон об авторском праве в США не обновлялся с 1976 года, поэтому судам приходится применять старые нормы к новым технологиям. Юрист Джейсон Хендерсон отмечает, что аргументация судов непоследовательна, но прослеживается закономерность: суды склонны выносить решения против ИИ-компаний, если созданный продукт напрямую конкурирует с рынком исходных материалов. Так произошло в деле Thomson Reuters против Ross Intelligence, где суд признал, что использование контента Reuters для создания конкурирующей юридической платформы не подпадает под добросовестное использование.
Отдельная сложность связана с авторскими правами на сам контент, созданный ИИ. В деле Thaler против Perlmutter суд постановил, что полностью созданное ИИ произведение не подлежит охране авторским правом, что порождает новые вопросы о том, как измерять степень участия ИИ в конкретной работе.
Поскольку большинство крупных ИИ-компаний всё ещё находятся в процессе судебных разбирательств, окончательная правовая база появится нескоро. Тем временем первые судебные решения продолжают влиять на поведение всей отрасли, хотя будущие решения судов ещё могут их пересмотреть.

