Отраслевые IT-ассоциации продолжают бороться с идеей брать плату за использование общедоступного авторского контента для обучения ИИ. Вместе с Альянсом в сфере ИИ против этой инициативы выступила Ассоциация больших данных (АБД), считая, что она ставит российских разработчиков в неравные конкурентные условия с иностранными компаниями, узнал Forbes. Создание инфраструктуры для такого учета потребует значительных затрат, которые окажутся выше самих выплат правообладателям, а сам предлагаемый механизм нереализуем, утверждают в АБД. Правообладатели, в свою очередь, называют этот подход попыткой лишить авторов защиты под предлогом инноваций
Ответный ход
АБД (объединяет «Яндекс», VK, «Сбер», Т-Банк, Россельхозбанк, Билайн, МТС, ВТБ, Avito, HeadHunter, Точка Банк, Аналитический центр при правительстве) выступила против введения обязательного вознаграждения правообладателям за использование общедоступных материалов при обучении ИИ. О своих опасениях президент АБД Анна Серебряникова сообщила в письме председателю комитета Госдумы по госстроительству и законодательству Павлу Крашенинникову, которое было отправлено 27 августа (есть в распоряжении Forbes).
Документ направлен в ответ на проект поправок в закон об ИИ и в части 4 Гражданского кодекса (об интеллектуальной собственности), которые ранее подготовила рабочая группа совета при президенте по кодификации и совершенствованию гражданского законодательства под руководством Крашенинникова. Группа в том числе предлагает обязать создателей нейросетей выплачивать правообладателям однократное вознаграждение за художественные произведения, которые использовались для обучения ИИ.
Разработать поправки к законодательству, которые призваны защитить интересы правообладателей при использовании контента для ИИ, поручил правительству и объединениям правообладателей президент Владимир Путин, писали «Ведомости».
«Технически невозможно»
Однако действующее законодательство уже предусматривает механизмы защиты правообладателей, а обучение модели некорректно приравнивать к использованию произведения в традиционном понимании авторского права, замечают в ассоциации. «Алгоритм обрабатывает большие массивы данных, выявляя статистические закономерности, связи и особенности языка. Защита авторских прав должна быть направлена прежде всего на случаи неправомерного воспроизведения, распространения охраняемого контента, а не на сам факт машинного анализа информации», — считают в АБД.
Более того, предлагаемый механизм нельзя реализовать на практике в масштабе современных ИИ-моделей, указывает в письме Серебряникова. Для этого нужно, в частности, определить состав использованных данных, установить правообладателя каждого объекта, подтвердить актуальность его прав, определить получателя и размер выплаты, а затем постоянно актуализировать эту информацию с учетом изменения и удаления материалов, смены правообладателей и условий лицензирования, перечисляет глава АБД.
АБД также обращает внимание на характер поправок, подвергая критике распространение требования на данные, использованные для обучения ранее созданных моделей. Ретроспективное установление состава обучающих массивов, статуса каждого объекта и принадлежности прав на него во многих случаях технически невозможно, констатируют в организации. Кроме того, в открытом доступе находятся миллиарды материалов, авторские права на часть из них установить невозможно, отмечает АБД. Создание инфраструктуры для такого учета потребует значительных административных и финансовых затрат, которые в ряде случаев могут оказаться выше самих выплат правообладателям, подчеркивают в ассоциации.
Все это ставит в неравные конкурентные условия с иностранными компаниями российских участников рынка, которые будут нести дополнительные расходы на обучение моделей и создание инфраструктуры учета, следует из письма. Таким образом, ограничения приведут не к росту доходов отечественных правообладателей, а к сокращению объемов данных, доступных нашим разработчикам, снижению качества российских моделей и их способности учитывать русский язык, российский культурный и информационный контекст, делают вывод в АБД.
Встречные предложения
В АБД при этом вносят свои предложения по регулированию. Среди них, к примеру, следующие:
- исключить введение обязательного вознаграждения за сам факт использования правомерно полученной и общедоступной информации при обучении ИИ-моделей;
- не допускать установления ретроспективных выплат за обучение ИИ-моделей;
- сохранить возможность правообладателя ограничить использование своих материалов с помощью понятного и технологически реализуемого механизма отказа;
- дать определение понятию «машинный анализ информации» применительно к обучению ИИ-моделей и предусмотреть его допустимость на законодательном уровне.
«В указанном виде не поддерживается»
В тот же день, что и письмо АБД, свое обращение к Павлу Крашенинникову отправил Альянс в сфере ИИ в лице его президента Валерии Воробьевой (копия есть у Forbes). Организация, в которую входят «Сбер», «Яндекс», VK, МТС, Билайн, Т-Банк, «Газпром нефть» и другие, также предложила закрепить в Гражданском кодексе возможность обучать модели на произведениях в свободном доступе и полученных на законных основаниях. В Альянсе указали, что дополнительные ограничения и финансовые обязательства могут привести к росту стоимости отечественных моделей и снижению их конкурентоспособности по сравнению с иностранными.
Проработка различных аспектов применения ИИ в отношении объектов авторского права «продолжается в диалоге с бизнесом», заявили в аппарате вице-премьера — главы аппарата правительства Дмитрия Григоренко. «В том числе в рамках рабочей группы «Медиаиндустрия и авторское право», созданной по решению Дмитрия Григоренко», — добавили там.
Важно найти баланс между защитой интересов правообладателей и развитием технологий ИИ в России, сообщили в Минцифры в ответ на запрос Forbes. «Согласно экспертному заключению рабочей группы «Регулирование и административные барьеры ИИ» при подкомиссии по вопросам развития технологий ИИ, инициатива в указанном виде не поддерживается», — подчеркнули в ведомстве. Такой механизм «может создать дополнительную техническую и административную нагрузку на бизнес, повысить стоимость разработки ИИ-моделей и повлиять на темпы развития отрасли», считают в Минцифры. «Новые механизмы должны быть понятными и реализуемыми на практике, не создавая избыточных барьеров для развития ИИ в России», — заявили в министерстве.
Сейчас разработчики ИИ используют для обучения моделей легально приобретенные труды художников, писателей и музыкантов, рассуждает генеральный директор Института исследований интернета Карен Казарян. «Если объект авторского права приобретен законным способом, это означает, что его нельзя воспроизводить и зарабатывать на нем. При этом можно читать, переписывать, писать фанфики и использовать другими способами», — продолжает он. В Евросоюзе еще в 2019 году законодательно прописали возможность автоматизированного анализа текстов и данных, если нет прямого запрета правообладателя, напоминает эксперт. Кроме того, технически невозможно организовать взимание платы за то, что ИИ нашел в интернете, обращает внимание Казарян: «Да и сами правообладатели не знают, кто и чем владеет — в России нет единого реестра объектов авторских прав».
Авторский подход
Представители правообладателей, в свою очередь, подвергают критике подход IT-ассоциаций. По логике последних, публичная доступность контента в интернете автоматически означает, что его можно использовать без согласия правообладателя, рассуждает генеральный директор Национальной федерации музыкальной индустрии (НФМИ) Никита Данилов. «Персональные данные с точки зрения информационного права тоже охраняемая информация: паспортные данные, данные о заказах еды и покупках в интернет-магазинах, данные со страниц соцсетей тоже «просто данные», которые где-то хранятся и уже не раз утекали в Сеть. Почему бы завтра не применить ту же логику и к ним? Разница, как нам объясняют, чисто техническая, а не принципиальная», — говорит он.
По мнению Данилова, если законодатель решил, что публичная доступность произведения автоматически означает разрешение на любое его использование, логично было бы применить тот же подход и здесь. «Открытые профили в соцсетях, утекшие базы данных доставки еды, история заказов в интернет-магазинах — тоже публично доступные данные, продолжает Никита Данилов. — На практике разница, конечно, есть, и очень простая: у персональных данных есть четкая и последовательно применяемая правовая охрана, а у объектов интеллектуальной собственности почему-то в этом вопросе решили сделать исключение. При этом принцип один и тот же: молчание не означает согласие. Просто в одном случае это называют прогрессом и инновациями, а в другом — утечкой персональных данных и заводят уголовное дело (хотя не всегда)».
Подход, при котором общедоступный авторский контент может использоваться для обучения моделей без разрешения правообладателя, «может создать опасный эффект», считает генеральный директор Ассоциации «Интернет-видео» Алексей Бырдин. Легальная копия фильма или сериала, защищенная DRM (Digital Rights Management, технологии защиты цифрового контента от несанкционированного копирования), оказывается менее пригодной для обучения ИИ, чем пиратская копия того же произведения, с которой техническая защита была удалена, говорит он. «Нарушение права одним лицом, в том числе обход или удаление DRM, не должно создавать для другого лица новое законное основание использования произведения, а регулирование ИИ — делать пиратскую копию юридически более привлекательной, чем легальную», — убежден он.
В комитете Госдумы по госстроительству и законодательству, Российском авторском обществе, а также Павел Крашенинников на запрос Forbes не ответили.
А как у них?
Тем временем американские власти поддержали позицию OpenAI в судебном споре с газетой The New York Times и другими издателями о том, что использование защищенных авторским правом материалов для обучения ИИ может считаться добросовестным, сообщил Reuters 2 сентября. В Минюсте США предупредили, что обязательное лицензирование такого контента способно затормозить развитие национальной ИИ-индустрии и дать преимущество иностранным конкурентам.
В своем заявлении, направленном в суд 1 сентября, ведомство указало, что США заинтересованы в развитии «сильной и конкурентоспособной» отрасли ИИ, способной задавать мировые стандарты. Решение в пользу OpenAI «будет способствовать инновациям и укреплению национальной безопасности», следует из документа. В ответ представители The New York Times раскритиковали позицию Минюста, заявив, что администрация защищает интересы многомиллиардных технологических корпораций в ущерб труду создателей контента.
Источник: Forbes
Министерство юстиции США встало на сторону OpenAI в споре об авторских правах с The New York Times (NYT) и другими...
Госинициатива поставит отечественных разработчиков в невыгодное положение по сравнению с зарубежными компаниями, опасаются в АБД.
...
В РФ готовят поправки к закону об ИИ, позволяющие авторам запрещать использование контента для обучения нейросетей через единый портал...