Введение
Вы наверняка знаете, что модели ИИ, лежащие в основе ChatGPT, Gemini, Claude и других чат-ботов, обучаются на практически бесконечных базах данных опубликованных произведений — сотнях миллионов книг, онлайн-статей, научных работ и практически на всём, что можно найти в интернете. Большинство опубликованных авторов, без их ведома и согласия, внесли вклад в развитие тех самых ИИ-инструментов, которые угрожают их средствам к существованию. Это кажется незаконным, не так ли?
Реальность не так проста.
Детали (цифры, факты)
В июне 2025 года судья Уильям Алсуп вынес одно из первых решений такого рода, обязав компанию Anthropic выплатить колоссальные 1,5 миллиарда долларов группе писателей, чьи произведения использовались для обучения моделей компании. На первый взгляд это выглядело как моральная победа авторов, но судья Алсуп на самом деле постановил, что обучение ИИ было законным. Штраф был наложен за то, что Anthropic получила книги из нелегальных онлайн-библиотек («теневых библиотек»).
Вот ключевые факты:
- 482 000+ книг были охвачены урегулированием по делу Bartz v. Anthropic
- Около 91% из этих книг были заявлены авторами или издателями
- Каждый автор получил примерно 3 000 долларов за книгу
- Судья Арасели Мартинес-Ольгин одобрила урегулирование 20 июля 2026 года
- Это стало крупнейшим известным восстановлением авторских прав в истории
В том же июне 2025 года судья Винс Чабрия в деле Kadrey v. Meta Platforms вынес решение в пользу Meta, признав, что использование книг для обучения моделей LLaMA является «трансформативным» и подпадает под доктрину добросовестного использования (fair use).
Однако в феврале 2025 года судья Стефанос Бибас в деле Thomson Reuters v. Ross Intelligence принял противоположное решение, постановив, что использование контента Reuters для создания конкурирующей ИИ-платформы не является добросовестным использованием.
Анализ
Вся эта правовая неопределённость вращается вокруг доктрины добросовестного использования (fair use) — исключения из закона об авторском праве, которое позволяет использовать защищённые материалы без явного разрешения. Судьи оценивают несколько факторов: цель и характер использования, объём заимствованного материала и его влияние на рынок.
Судья Алсуп сравнил обучение ИИ с тем, как писатель изучает литературу: «Подобно любому читателю, стремящемуся стать писателем, LLM компании Anthropic обучались на произведениях не для того, чтобы обогнать и заменить их, а для того, чтобы повернуть за угол и создать что-то новое».
Ключевой момент: закон об авторском праве не обновлялся с 1976 года. Судьям приходится интерпретировать нормы 50-летней давности применительно к вопросам, которые могут определить будущее всей ИИ-индустрии.
Как отмечает адвокат Кэти Геллис, специализирующаяся на интеллектуальной собственности: «Закон об авторском праве строится на копировании, но он не строится на использовании произведения, его потреблении или чтении».
Различие между делами показательно:
- Anthropic и Meta — обучение на книгах для создания общих языковых моделей признано трансформативным (fair use)
- Ross Intelligence — обучение на контенте Reuters для создания прямого конкурента признано нарушением
- Источник данных — использование пиратских копий из теневых библиотек влечёт ответственность, даже если само обучение законно
Мнение
Ситуация парадоксальна. С одной стороны, суды признают обучение ИИ на книгах законным, если данные получены легально. С другой — почти все крупные ИИ-компании использовали пиратские источники, и именно за это их наказывают.
Но давайте посмотрим на это шире. Штраф в 1,5 миллиарда долларов для компании, которая прогнозирует около 200 миллиардов долларов годовой выручки к 2028 году, — это не более чем стоимость ведения бизнеса. Авторы получают по 3 000 долларов за книгу — сумму, которая вряд ли компенсирует ущерб от потери рынка.
Проблема глубже: закон не поспевает за технологиями. Пока суды разбираются, ИИ-компании продолжают обучать модели на всём подряд, а авторы остаются в подвешенном состоянии. Дело Thaler v. Perlmutter добавило ещё один слой сложности: если произведение создано ИИ на 100%, оно не подлежит авторскому праву. Но как доказать, какой процент текста создан человеком, а какой — машиной?
Я считаю, что нам нужна не судебная, а законодательная реформа. Существующая система, при которой каждый случай рассматривается отдельно и решения противоречат друг другу, не работает ни для авторов, ни для ИИ-компаний. Нужны чёткие правила лицензирования и компенсации, а не бесконечные судебные тяжбы.
Итог
Итак, законно ли обучать ИИ на защищённых авторским правом книгах? Ответ: зависит от обстоятельств.
- Если книги получены легально и используются для создания общих моделей — скорее всего, да (fair use)
- Если книги получены из пиратских источников — нет, это нарушение
- Если модель создаётся для прямой конкуренции с авторами — скорее всего, нет
- Если ИИ генерирует контент, который конкурирует с оригинальными произведениями — возможна ответственность
Пока апелляционные суды не вынесут окончательные решения, а Конгресс не обновит закон, правовая неопределённость сохранится. А это значит, что и авторы, и ИИ-компании продолжат жить в состоянии юридической неопределённости.
FAQ
Вопрос: Получат ли авторы компенсацию за использование их книг в обучении ИИ?
Ответ: В деле Anthropic авторы получили около 3 000 долларов за книгу в рамках урегулирования на 1,5 миллиарда долларов. Однако это касается только книг, полученных из пиратских источников. Для легально полученных книг суды пока не требуют компенсации.
Вопрос: Может ли ИИ-компания использовать мою книгу для обучения без моего согласия?
Ответ: Согласно последним решениям судов (Bartz v. Anthropic, Kadrey v. Meta), обучение ИИ на легально полученных книгах признаётся «трансформативным» использованием и подпадает под доктрину fair use. Однако если книга получена из пиратского источника, компания может быть привлечена к ответственности.
Вопрос: Защищены ли авторским правом тексты, созданные ИИ?
Ответ: Согласно решению по делу Thaler v. Perlmutter, произведение, созданное ИИ на 100% без значимого участия человека, не подлежит авторской защите. Однако вопрос о том, какой процент человеческого участия требуется, остаётся открытым.