Суд приравнял обучение ИИ к чтению книг

Обучение моделей для ChatGPT, Gemini, Claude и других чат-ботов на книгах, статьях, научных работах и другом опубликованном контенте уже стало предметом споров о нарушении авторских прав. Однако юристы отмечают, что с правовой точки зрения ситуация не так однозначна, как может показаться.

Как рассказала TechCrunch юрист Кэти Геллис, которая занимается вопросами интеллектуальной собственности, авторского права и технологий, в этой теме слишком много факторов и сильных эмоций с обеих сторон. По ее словам, право и технологии здесь пересекаются в очень запутанном виде.

Один из самых заметных эпизодов произошел в прошлом году, когда судья Уильям Алсап обязал Anthropic выплатить 1,5 млрд долларов по иску группы писателей, чьи книги использовались при обучении ИИ-моделей компании. При этом сам факт обучения модели суд признал законным. Нарушением, по мнению суда, стало то, что книги были получены из пиратских онлайн-библиотек.

В решении Алсап написал: «Как и любой читатель, который хочет стать писателем, LLM Anthropic обучались на этих произведениях не для того, чтобы обогнать, скопировать или вытеснить их, а чтобы свернуть в другую сторону и создать нечто иное». Судья сравнил то, как большая языковая модель усваивает триллионы слов, с тем, как писатель изучает литературу.

Геллис считает, что это решение в большей степени выгодно ИИ-компаниям. По ее мнению, важнее то, что судья фактически приравнял обучение ИИ к чтению произведения, а не к его копированию.

«Я думаю, для обучения ИИ это в целом хорошая новость, потому что он посмотрел на происходящее и счел это скорее аналогом чтения защищенного произведения, чем его копирования», — сказала Геллис. Она добавила, что авторское право строится именно вокруг копирования, а не вокруг использования, восприятия или чтения произведения.

Проблему усложняет и то, что закон об авторском праве в США не обновлялся с 1976 года. В итоге судам приходится применять нормы почти 50-летней давности к вопросам, которые напрямую влияют на будущее ИИ-индустрии.

Старший юрист и основатель практики IP & Media в JWL International Джейсон Хендерсон сказал TechCrunch, что сейчас многие обеспокоены из-за разрозненности судебных подходов. «Все очень встревожены, потому что в законе нет единой линии, и причина именно в этом вопросе. Все понимают, что ИИ-модели обучены на огромном количестве материалов, а право пока не успело на это ответить», — отметил он.

Во многих таких делах ключевым становится принцип fair use — допустимого использования. Суд оценивает, достаточно ли использование чужого произведения меняет его исходный характер, чтобы считаться законным без отдельного разрешения правообладателя.

Этот принцип допускает использование защищенных материалов без прямого согласия автора, например для критики, пародии, образования и других целей. При разборе суды смотрят на назначение и характер использования, объем заимствования и влияние на рынок.

«Авторское право всегда связано с защитой и ростом рынка», — сказал Хендерсон. По его словам, в делах об ИИ суды часто смотрят на то, создается ли новый продукт для прямой конкуренции с правообладателем. Если да, отношение суда обычно жестче. Если нет, суды чаще находят основания признать такое использование допустимым.

В качестве примера Хендерсон сослался на дело Thomson Reuters против Ross Intelligence. Медиа- и технологическая компания обвинила исследовательскую фирму в копировании ее контента для создания конкурирующей юридической платформы на базе ИИ.

Судья Стефанос Бибас тогда написал: «Использование Ross не является преобразующим, потому что у него нет “дополнительной цели или иного характера” по сравнению с Thomson Reuters». Суд пришел к выводу, что обучение на контенте Reuters для создания сервиса, который напрямую конкурирует с ним, не подпадает под fair use.

Авторы книг теоретически тоже могут утверждать, что чат-боты конкурируют с ними, используя их тексты для генерации новых синтетических книг. Но на данный момент такой довод еще не получил поддержки в суде.

Геллис также предлагает разделять два вопроса: использование защищенных произведений для обучения ИИ и возможность получить авторские права на контент, созданный самой моделью. Это разные юридические темы, хотя их часто обсуждают вместе.

В деле Thaler v. Perlmutter суд постановил, что произведение, созданное на 100% ИИ, не может охраняться авторским правом. Это, в свою очередь, порождает новые вопросы: как доказать, был ли текст или изображение создан ИИ, и как определить долю участия человека.

«Если вы пишете роман в Word и используете проверку орфографии, мы вполне спокойно исходим из того, что Word не владеет вашим романом», — сказала Геллис. По ее словам, ИИ заставляет заново пересматривать многие решения, которые раньше почти не обсуждались.

Большинство ИИ-компаний до сих пор участвуют в незавершенных судебных разбирательствах по этим вопросам. Это значит, что быстрого окончательного ответа на споры об авторском праве и обучении ИИ пока не будет.

«Сейчас вы видите, что первые судебные решения уже сильно влияют на ситуацию, но это влияние может быть пересмотрено, если другие суды примут иные решения. Понадобятся более поздние этапы разбирательств, чтобы понять, какой подход возобладает. Но уже сейчас все эти решения формируют происходящее, и ИИ-компаниям было бы неразумно их игнорировать», — сказала Геллис.

Источник: TechCrunch.

Читать новости ИИ и технологий в Telegram.


Оцените статью
Gimal-Ai