Законно ли обучать ИИ на защищённых авторским правом книгах? Однозначного ответа пока нет
Судебная практика в США показывает, что обучение ИИ-моделей на материалах, защищённых авторским правом, часто признаётся законным, однако общая правовая картина остаётся запутанной.

Крупные языковые модели, лежащие в основе таких чат-ботов, как ChatGPT, Gemini и Claude, обучаются на огромных массивах текстов — сотнях миллионов книг и статей, многие из которых использовались без ведома и согласия авторов. Однако, по словам юристов, это не означает автоматически, что подобная практика незаконна.
В прошлом году судья Уильям Алсап обязал компанию Anthropic выплатить 1,5 миллиарда долларов группе писателей, чьи произведения использовались при обучении её ИИ-моделей. Несмотря на масштаб выплаты, само решение фактически признало обучение моделей на этих книгах законным — Anthropic оштрафовали именно за получение книг из пиратских "теневых библиотек", а не за их использование в обучении. Алсап сравнил процесс усвоения моделью огромных объёмов текста с изучением литературы писателем, отметив, что цель заключалась в создании нового, а не в копировании существующего.
Законодательство, не поспевающее за технологиями
Американское законодательство об авторском праве существенно не менялось с 1976 года, из-за чего судьям приходится применять десятилетиями старые нормы к новым спорам, связанным с ИИ. Значительная часть дискуссии строится вокруг доктрины "добросовестного использования" (fair use), позволяющей использовать защищённые материалы без разрешения, если такое использование достаточно "трансформативно". Суды учитывают цель использования, объём заимствованного материала и влияние на рынок оригинала.
Противоположный пример — дело Thomson Reuters против Ross Intelligence, где суд решил, что использование контента Reuters для создания напрямую конкурирующей ИИ-платформы для юридических исследований не является добросовестным использованием. Юристы отмечают, что суды чаще встают на сторону ИИ-компаний, если их продукты не конкурируют напрямую с источником, и относятся к делу более критично, если конкуренция присутствует.
Ещё один нерешённый вопрос касается контента, созданного самим ИИ: по делу Thaler против Perlmutter суд постановил, что полностью сгенерированные ИИ произведения не подлежат защите авторским правом, что порождает дополнительные вопросы о том, как определять долю участия ИИ в создании работы.
Поскольку большинство крупных ИИ-компаний по-прежнему участвуют в судебных разбирательствах, окончательной правовой ясности ждать пока не приходится. Тем временем первые судебные решения продолжают влиять на работу всей отрасли, хотя последующие вердикты ещё могут изменить сложившуюся практику.

