Дебаты о авторском праве: Использование книг для обучения искусственного интеллекта
Подробнее
Olhar Digital
olhardigital.com.br

Дебаты о авторском праве: Использование книг для обучения искусственного интеллекта

Модели искусственного интеллекта, лежащие в основе таких инструментов, как ChatGPT, Gemini и Claude, были разработаны с использованием обширных баз данных, содержащих сотни миллионов книг, статей, научных работ и интернет-контента. Центральным предметом спора является то, что большинство авторов, чьи произведения составляют эти наборы данных, никогда не были проконсультированы или не давали своего согласия на такое использование.

Юридическая сложность этого вопроса была рассмотрена Кэти Геллис, адвокатом, специализирующимся на интеллектуальной собственности, авторском праве и технологиях, в интервью TechCrunch. Она отметила, что юридическая и технологическая сферы переживают интенсивные изменения, вызывая сильные мнения как за, так и против этой практики.

В новаторском деле судья Уильям Алсуп приказал компании Anthropic выплатить коллективу писателей, чьи работы использовались для обучения моделей ИИ компании, 1,5 миллиарда долларов США. Однако Алсуп пришел к выводу, что сам процесс обучения был законным, наказав только незаконное приобретение книг из неавторизованных цифровых библиотек.

В этом решении судья установил аналогию между процессом поглощения триллионов слов языковой моделью и чтением, которое студент совершает при изучении существующих произведений для создания чего-то нового. Алсуп заявил, что LLM от Anthropic обучались на произведениях не для их воспроизведения или замены, а для преодоления концептуальных проблем и генерации различных результатов.

Геллис оценивает, что вердикт более выгоден ИИ-корпорациям, чем самим авторам. Для компании, которая прогнозирует годовой доход в размере около 200 миллиардов долларов к 2028 году, штраф в 1,5 миллиарда долларов имеет иную финансовую значимость. Она прокомментировала, что положительно для развития ИИ, что суд признал сходство с чтением материала, защищенного авторским правом, вместо того чтобы рассматривать это как простое копирование.

По словам Геллис, американское законодательство об авторском праве не пересматривалось с 1976 года, что вынуждает судей толковать директивы пятилетней давности для разрешения дилемм, которые могут определить будущее индустрии ИИ. Большая часть судебных разбирательств сосредоточена на концепции добросовестного использования (fair use), которая определяет, является ли использование защищенного произведения достаточно «трансформационным» для законного разрешения. Это исключение из авторского права позволяет использовать материал без явного разрешения в таких целях, как критика, пародия и образование, при этом анализируются такие факторы, как цель использования, объем использованного материала и влияние на оригинальный рынок.

Джейсон Хендерсон, старший юрист и основатель Практики интеллектуальной собственности и медиа JWL International, заявил TechCrunch, что авторское право всегда направлено на защиту и расширение рынка. Он добавил, что суды наказывали случаи, когда обучение произведения направлено на прямую конкуренцию с ним, но склонны принимать использование, которое не создает этой прямой конкуренции.

Примером этого стал иск, поданный Thomson Reuters против Ross Intelligence, которая скопировала контент для разработки юридической платформы на базе ИИ с потенциально конкурирующим продуктом. Судья Стефанос Бибас счел, что использование не было трансформационным, поскольку ему не хватало «дополнительной цели или иного характера» по сравнению с контентом Thomson Reuters.

Хотя авторы могут утверждать, что чат-боты конкурируют с ними, используя их произведения для создания новых синтетических книг, этот аргумент пока не увенчался успехом в судах. Геллис подчеркивает, что взаимосвязь между ИИ и авторским правом охватывает две различные темы: использование произведений при обучении моделей и защита контента, созданного ИИ. В другом судебном разбирательстве в США суд постановил, что полностью сгенерированное ИИ произведение не может быть защищено авторским правом, что вносит новую неопределенность в то, как доказать происхождение произведения и какой процент его происходит от человеческого авторства или машинной помощи.

Поскольку ИИ вынуждает переоценивать ранее пренебрегаемые концепции, Геллис заключает, что большинство ИИ-компаний по-прежнему сталкиваются с судебными процессами. Она предупреждает, что первоначальные решения влиятельны, но могут быть отменены другими судами, что указывает на то, что правовая ситуация будет продолжать развиваться.

Популярное