Создание ИИ-продукта: что учесть на каждом этапе, чтобы не получить штраф и претензии
Чат-боты и ИИ-агенты стали полноценными помощниками, но при создании такого продукта нужно учитывать множество факторов, и не только технических. Например, модель не должна обучаться на персональных данных и охраняемых объектах интеллектуальной собственности без лицензии, а ее разработчики могут установить запрет на использование в России. Кроме этого, нарушить закон могут и пользователи ИИ-продукта. В итоге ошибка на любом этапе будет стоить миллионы, повлечет претензии и репутационный ущерб. Разобрались вместе с юристами, на что обратить внимание, чтобы этого избежать.
Развитие искусственного интеллекта позволило создавать новые продукты на базе этой технологии. Это, например, чат-боты или ИИ-агенты, которые собирают данные и анализируют их, обрабатывают заказы клиентов и общаются с ними, отвечают на письма, прогнозируют спрос и риски. Такого помощника довольно легко и быстро создать, и глубоких навыков программирования для базового продукта не нужно. Но его создание и выпуск может обернуться нарушениями и штрафами, если не учесть юридические тонкости на каждом этапе.
Сбор, анализ и подготовка данных
Проблемы возникают и при использовании публичной информации. Например, американская газета The New York Times подала иск к OpenAI и Microsoft из-за того, что их ИИ-системы используют материалы журналистов с сайта газеты и таким образом обучаются. В России спор по поводу общедоступных данных тоже был — это разбирательство «ВКонтакте» и «Дабл Дата» (дело № А40-18827/2017). Социальная сеть посчитала, что сбор данных с ее сайта незаконен, так как это все база данных, которая принадлежит «ВКонтакте». «То есть содержимое сайта рассматривается как охраняемый объект ИС даже в тех случаях, когда сами по себе данные не произведение и не принадлежат владельцу ресурса», — разъясняет партнер и руководитель практики IP / TMT Comply Максим Али.
Еще есть проблемы с использованием данных, которые охраняются как нематериальные блага. Это, например, право на изображение и голос, который используют для генерации синтезированной речи.
«Если модель обучается на большом объеме общедоступных данных, то гарантировать 100%-ю юридическую чистоту датасета невозможно. Даже если разработчик проверяет такую чистоту (собирает согласия, использует специальные базы, синтезированные данные и подобное), остается вероятность наткнуться на специфичные объекты прав наподобие нематериальных благ и столкнуться с отзывом согласия. Есть и вероятность банальной ошибки, которая сама по себе не будет исключать ответственность, — за нарушение прав на ИС коммерческая организация отвечает независимо от того, есть ли вина».
Максим Али, партнер и руководитель практики IP Comply
Подробнее:pravo.ru
Чат-боты и ИИ-агенты стали полноценными помощниками, но при создании такого продукта нужно учитывать множество факторов, и не только технических. Например, модель не должна обучаться на персональных данных и охраняемых объектах интеллектуальной собственности без лицензии, а ее разработчики могут установить запрет на использование в России. Кроме этого, нарушить закон могут и пользователи ИИ-продукта. В итоге ошибка на любом этапе будет стоить миллионы, повлечет претензии и репутационный ущерб. Разобрались вместе с юристами, на что обратить внимание, чтобы этого избежать.
Развитие искусственного интеллекта позволило создавать новые продукты на базе этой технологии. Это, например, чат-боты или ИИ-агенты, которые собирают данные и анализируют их, обрабатывают заказы клиентов и общаются с ними, отвечают на письма, прогнозируют спрос и риски. Такого помощника довольно легко и быстро создать, и глубоких навыков программирования для базового продукта не нужно. Но его создание и выпуск может обернуться нарушениями и штрафами, если не учесть юридические тонкости на каждом этапе.
Сбор, анализ и подготовка данных
Проблемы возникают и при использовании публичной информации. Например, американская газета The New York Times подала иск к OpenAI и Microsoft из-за того, что их ИИ-системы используют материалы журналистов с сайта газеты и таким образом обучаются. В России спор по поводу общедоступных данных тоже был — это разбирательство «ВКонтакте» и «Дабл Дата» (дело № А40-18827/2017). Социальная сеть посчитала, что сбор данных с ее сайта незаконен, так как это все база данных, которая принадлежит «ВКонтакте». «То есть содержимое сайта рассматривается как охраняемый объект ИС даже в тех случаях, когда сами по себе данные не произведение и не принадлежат владельцу ресурса», — разъясняет партнер и руководитель практики IP / TMT Comply Максим Али.
Еще есть проблемы с использованием данных, которые охраняются как нематериальные блага. Это, например, право на изображение и голос, который используют для генерации синтезированной речи.
«Если модель обучается на большом объеме общедоступных данных, то гарантировать 100%-ю юридическую чистоту датасета невозможно. Даже если разработчик проверяет такую чистоту (собирает согласия, использует специальные базы, синтезированные данные и подобное), остается вероятность наткнуться на специфичные объекты прав наподобие нематериальных благ и столкнуться с отзывом согласия. Есть и вероятность банальной ошибки, которая сама по себе не будет исключать ответственность, — за нарушение прав на ИС коммерческая организация отвечает независимо от того, есть ли вина».
Максим Али, партнер и руководитель практики IP Comply
Подробнее:pravo.ru