Искусственный интеллект · 1 мая 2024 · 7 мин чтения

Защита прав интеллектуальной собственности при обучении генеративного ИИ

В мае 2024 г. Китай опубликовал проект Базовых требований к безопасности генеративного ИИ, заложив требования к его операторам по мерам пресечения нарушений прав интеллектуальной собственности (далее – прав ИС). Например, если в наборе данных, на которых обучается ИИ, содержатся литературные, художественные и научные произведения, провайдер обязан провести проверку на предмет нарушений прав ИС в с

Из выпуска мониторинга №5, май 2024 · выпуск целиком, PDF · на сайте Института Гайдара

Генеративный ИИ позволяет создавать новый контент (текст, компьютерный код, изображения, аудио- и видео) в ответ на запрос пользователя. Обучение такого ИИ часто происходит на открытых данных, которые могут содержать охраняемые правами ИС объекты. Это ведет к риску создания произведений, схожих с защищаемыми произведениями других авторов.

Поэтому в мае 2024 г. в Китае и ЕС были приняты первые правила о защите прав ИС при обучении генеративного ИИ, что было вызвано рядом судебных дел, когда правообладатели подавали жалобы на обучении ИИ на основе их работ без их разрешения.

Опыт Китая

В мае 2024 г. Китай опубликовал проект «Базовых требований к безопасности1 генеративного ИИ» . Поставщики услуг генеративного ИИ должны:

1) назначить лицо, ответственное за соблюдение прав ИС при использовании ИС системой и в генерируемом контенте;

2) иметь стратегию обеспечения соблюдения прав ИС, включая перечень рисков нарушения прав ИС;

3) при нарушении прав ИС – не использовать наборы данных с нарушением для обучения ИИ, провести проверку нарушения;

4) обеспечить механизм подачи жалоб от пользователей поставщику о нарушениях прав ИИ генеративным ИИ.

Что касается необходимости получения разрешения от правообладателей на используемый контент для обучения ИИ, в феврале 2024 г. Суд в Гуанчжоу привлек к ответственности владельца сайта, на котором предоставлялась услуга генерации контента за деньги. Суд пришел к выводу, что система работала таким образом, что по запросу пользователя создавалось изображение, которое было схоже до степени смешения с объектом интеллектуальной собственности истца. Практика суда показывает, что ИИ, который позволяет пользователю сделать запрос о генерации контента, предполагающий копирование ИС или его отдельных элементов, будет трактоваться как нарушение законодательства о ИС. В данном случае применяется общее правило о запрете на коммерческое использование2 ИС без лицензии правообладателя .

При этом суд в Китае признает авторские права пользователя ИИ на сгенерированные ИИ произведения. В ноябре 2023 г. Суд Пекина принял решение по делу о нарушении авторских прав на изображение, созданное с использованием Stable Diffusion. Изображения, сгенерированные ИИ, являются «произведениями» по закону об авторских правах, так как относятся к области литературы, искусства, являются оригинальными и представляют результат интеллектуальной деятельности человека. Автором признается истец, который ввел запрос ключевых слов (вид изображения, изображаемый объект, окружение и стиль) и далее корректировал запрос. Суд исключил авторство разработчиков системы ИИ на сгенерированное изображение.

Опыт ЕС, Франции, Италии

Принятый в мае 2024 г. Закон ЕС по ИИ устанавливает обязанность провайдеров генеративного ИИ:

1) внедрять комплаенс выполнения законодательства о защите авторских прав (например, проверять используемые ИИ данные на наличие защищенных объектов ИС);

2) опубликовать подробное описание (резюме) о контенте, используемом для обучения модели ИИ (ч.1 ст.53), например, перечисление основных наборов данных, включая указание на крупные частные или общедоступные базы данных или архивы. Планируется разработать форму такого резюме.

В ЕС существует право использовать ИС без разрешения правообладателей в научных целях исследовательскими организациями и учреждениями культурного наследия. Аналогично ст. 23 Закона об3 авторских правах Китая .

Среди стран ЕС Франция первая в сентябре 2023 г. представила Законопроект4 № 1630 об обязательном получении согласия правообладателей при использовании объектов ИС для систем ИИ в том числе при обучении систем генеративного ИИ. Без разрешения автора возможно использование только в некоммерческих целях. Это снижает риски неправомерного коммерческого использования объектов ИС и при сохранении возможности свободного использования таких объектов для социально полезных целей.

Если произведение создается ИИ «без прямого вмешательства человека», то правообладателями являются авторы или правообладатели произведений, которые сделали возможным создание данного произведения (ст. 2). Однако остается не ясным, как должны определяться конкретные произведения, ставшие основой для генерации, каким образом должно распределяться авторское право на произведение, сгенерированное ИИ?

Законопроектом Франции предлагается внедрить коллективное управление сгенерированными ИИ произведениями через организации коллективного управления (для сбора роялти). Законопроект не решает проблему использования для обучения произведений, авторов которых не было возможности установить. Такое предложение несет в себе риски неправильного определения авторов произведения, нарушения прав авторов на имя и на вознаграждение за использование их произведений.

Также Франция предлагает обязать делать пометки, что произведение сгенерировано системой ИИ – аналогичная норма была предложена проектом закона об ИИ Италии (апрель 2024 г.). Необходимо использовать знак или маркировку с5 аббревиатурой «IA» (intelligenza artificiale) . Что касается использования охраняемой ИС для обучения ИИ, Италия, в отличие от ЕС и Франции, предложила другой подход – право на свободное использование данных, к которым имеется законный доступ, для обучения систем ИИ, если такое использование прямо не запрещено правообладателями.

Опыт США

В США специальное регулирование не установлено. По общему правилу применяется доктрина «добросовестного использования» защищенных авторским правом данных – возможно использование объектов ИС без лицензии в обстоятельствах, определяемых:

1) целью (например, образовательной);

2) характером использования (некоммерческим). Это не значит, что любое некоммерческое использование признается добросовестным, а коммерческое – недобросовестным. Например, «преобразующее использование» (добавление чего-то нового) вероятно будет считаться добросовестным. Использование комбинации изображения и текста для обучения ИИ является по сути «преобразующим» по сравнению с исходными данными, что теоретически признается добросовестным использованием;

3) природой самих данных: чем больше выражен творческий элемент, тем ниже шансы на признание добросовестного использования;

4) объемом использованных данных источника;

5) влиянием на рынок и стоимость защищенных данных – наносит ли нелицензированное использование вред существующему (например, вытесняя продажи оригинала) или будущему рынку (оригинал станет менее используемым).

В 2023 г. в США были поданы иски американских писателей против OpenAI за использование их текстов для обучения ChatGPT и копирования работ без разрешения; иск художников против Stability AI, Deviantart и Midjourney за неразрешенное использование для обучения ИИ изображений, защищенных авторским правом, для получения большего количества произведений того же типа без согласия авторов оригинальных изображений. Жалобы приняты к рассмотрению, однако решения пока не вынесены.

Опыт России

В России отсутствует регулирование ИС для обучения ИИ.

Однако возможно применение ст. 1274 ГК РФ – право использовать обнародованное произведение или его часть без согласия правообладателя и без выплаты вознаграждения для информационных, учебных или культурных целей. Требуется указать имя автора и источник. То есть при соблюдении перечисленных условий использование объектов ИС может квалифицироваться как цитирование, а объекты ИС могут использоваться для обучения генеративного ИИ в коммерческих целях, что влечет нарушение ИС правообладателей.

Таким образом, можно выделить 3 подхода стран к использованию данных для обучения ИИ:

1) требование к поставщикам услуг ИИ по комплаенсу для защиты ИС и публикации информации о данных, используемых для обучения ИИ (ЕС, Франция и Китай). При чем по общему правилу требуется обязательное получение разрешения от правообладателей на коммерческое использование ИС, без разрешения – только в некоммерческих целях.

Суды Китая и законопроект во Франции предлагают распространить общее правило о получении разрешения от правообладателей о коммерческом использовании ИС для обучения ИИ;

2) отсутствие специальных требований к операторам ИИ (США) при возможности добросовестного использования ИС для обучения ИИ без лицензии;

3) возможность свободного использования ИИ без разрешения правообладателей, исключение – прямой запрет правообладателя на использование (Италия).

Российский подход в части права использования произведений для обучения ИИ без разрешения схож с подходами ЕС и Франции. При этом в России нет механизмов защиты правообладателей от неправомерного использования объектов ИС для обучения систем генеративного ИИ.

Для создания таких механизмов возможно дополнить часть 4 ГК РФ нормами о: - праве автора/ правообладателя запретить использование произведения для обучения систем ИИ / алгоритмов; - маркировки произведений, созданных с использованием ИИ/алгоритмов.


Материал из выпуска мониторинга №5, май 2024. Скачать выпуск целиком (PDF) · страница выпуска на сайте Института Гайдара

Читайте также

Искусственный интеллект

evfrferv

11 сентября 2026