Коммерсантъ FM

ИИ ищет право на обучение

Власти США поддержали OpenAI в споре об обучении ИИ на чужом контенте

Администрация президента США Дональда Трампа поддержала OpenAI в судебном споре с The New York Times и другими изданиями об использовании защищенных авторским правом материалов для обучения искусственного интеллекта, сообщает Reuters. Правительство направило в федеральный суд Манхэттена заключение, согласно которому обучение больших языковых моделей на таких материалах, как правило, может подпадать под принцип добросовестного использования (fair use). Документ не имеет обязательной силы для суда, однако, по данным Reuters, это, по всей видимости, первый случай, когда власти США официально высказались по существу многочисленных споров об авторских правах и обучении ИИ.

Фото: Евгений Павленко / Коммерсантъ

Фото: Евгений Павленко / Коммерсантъ

Американские власти считают обучение ИИ преобразующим использованием защищенных материалов. Ограничение развития больших языковых моделей из-за слишком узкого толкования принципа fair use, по мнению администрации, может затормозить научный прогресс и ослабить позиции США в сфере ИИ. Развитие технологии власти также связывают с экономическими интересами и национальной безопасностью страны.

The New York Times с такой позицией не согласна. Издание считает, что она фактически дает преимущество крупнейшим ИИ-компаниям за счет авторов и издателей. По мнению газеты, разработчики должны платить за контент, который используют при создании своих продуктов. Иск NYT против OpenAI и Microsoft был подан еще в 2023 году: издатель обвиняет компании в использовании без разрешения миллионов газетных материалов для обучения ChatGPT. Аналогичные претензии к OpenAI, Anthropic, Meta (признана экстремистской и запрещена в РФ) и другим разработчикам предъявляют и другие правообладатели.

Ключевым для таких процессов остается вопрос, можно ли считать обучение ИИ на защищенных произведениях добросовестным использованием. Единого ответа американская судебная практика пока не выработала: первые решения по подобным спорам расходились. Позиция правительства может усилить аргументы разработчиков, однако сама по себе не делает обучение ИИ на чужом контенте безусловно законным — окончательные границы применения fair use предстоит определить судам.

Как в России

В России специальная норма об использовании произведений для обучения ИИ уже принята, но пока не действует. Закон «О поддержке развития технологий искусственного интеллекта в Российской Федерации» вступил в силу 1 сентября 2026 года, но его статья 10, которая касается использования объектов авторского и смежного права, заработает только с 1 марта 2027 года.

До этого использование произведений для обучения ИИ остается в рамках общих правил авторского права, поясняет старший IP/IT юрист ASB Consulting Group Виктория Ванюшкина. По общему принципу для использования произведения требуется согласие правообладателя: произведение нельзя использовать новым способом только потому, что правообладатель прямо этого не запретил.

С 1 марта 2027 года закон установит специальное исключение для обучения суверенных и национальных больших фундаментальных моделей. При определенных условиях не будет считаться нарушением авторских и смежных прав анализ содержащейся в произведениях информации и их краткосрочная запись в память компьютера для обучения таких моделей. Это будет возможно, если разработчик правомерно получил экземпляр произведения либо если оно было доведено до всеобщего сведения и доступно для анализа без технических ограничений.

Так, разработчик сможет использовать для обучения, например, законно приобретенное произведение или доступный в интернете контент при соблюдении установленных законом условий, объясняет госпожа Ванюшкина. Отдельной обязанности выплачивать правообладателю вознаграждение за такое использование закон также не устанавливает, отмечает она.

Фактически это меняет привычную для авторского права логику, поясняет Виктория Ванюшкина: если сейчас сначала требуется согласие правообладателя — принцип opt-in, то новое регулирование приближается к принципу opt-out, когда использование допускается без отдельного разрешения, если соблюдены предусмотренные законом условия.

При этом речь не идет о том, что любой размещенный в интернете контент автоматически станет свободным для обучения ИИ. Правообладатель сможет защитить публичный контент от автоматизированного анализа техническими средствами, отмечает адвокат и партнер адвокатского бюро Pareto Legal Алексей Истомин. При этом простой значок © или фраза «использование для обучения ИИ запрещено» законом прямо не признаны достаточным способом такого отказа, уточняет он.

Два подхода

Одно из ключевых различий американского и российского подходов заключается в том, как определяются границы допустимого использования защищенных произведений. В США принцип fair use закреплен в законодательстве, однако его применимость к обучению ИИ суд оценивает с учетом обстоятельств конкретного дела. Суд, в частности, учитывает цель и преобразующий характер использования, характер произведения, объем заимствования и потенциальный ущерб рынку правообладателя, напоминает Алексей Истомин. Поэтому позиция американского правительства усиливает аргументы OpenAI, но не означает, что обучение моделей на защищенном контенте автоматически признается законным, поясняет юрист.

Россия выбрала более формализованный подход, отмечает юрист, основатель и CEO консалтинговой группы vvCube Вадим Ткаченко. Законодатель пытается заранее определить случаи и условия, при которых использование произведений для обучения определенных ИИ-моделей не будет считаться нарушением авторских и смежных прав. При этом и российское регулирование не устанавливает универсального принципа, согласно которому любой опубликованный в интернете контент можно свободно использовать для обучения, подчеркивает он.

Таким образом, в США применимость закрепленного в законе принципа fair use к обучению ИИ во многом определяется судебной практикой, тогда как в России для обучения определенных категорий моделей вводится специальная законодательная норма, говорит господин Ткаченко. Но и российская модель пока оставляет ряд вопросов, которые в дальнейшем могут стать предметом судебных споров, добавляет он.

В частности, закон не объясняет, что именно следует считать «краткосрочной записью» произведения в память компьютера и достаточным «ограничением техническими средствами», отмечает Алексей Истомин. Кроме того, статья 10 принята в отдельном федеральном законе, тогда как статья 1229 ГК РФ предусматривает, что ограничения исключительных прав устанавливаются Гражданским кодексом, обращает внимание юрист. Эту возможную коллизию еще предстоит разрешать на практике.

Еще одна проблема касается доказательств. Правообладателю может быть сложно установить, входило ли конкретное произведение в обучающий датасет, откуда разработчик его получил и каким образом использовал, отмечает партнер и руководитель практики разрешения споров Semenov&Pevzner Екатерина Калиничева. При этом сама по себе сложность доказывания не означает, что использование произведения становится законным, подчеркивает она.

Одновременно с этим с конца июля обсуждается перенос правил об обучении ИИ непосредственно в гражданский кодекс, напоминает Виктория Ванюшкина. В числе предложений — признать обучение нейросетей отдельным способом использования произведения, предусмотреть выплаты правообладателям и организовать их сбор через специальные организации. Это позволило бы авторам получать вознаграждение за использование их контента, поясняет юрист.

Однако такой подход также создает риски, считает госпожа Ванюшкина. Авторское право защищает конкретное произведение — например, текст, изображение или дизайн,— но не содержащиеся в нем идеи и концепции. При обучении нейросеть анализирует большие массивы данных, выявляя связи и закономерности. Если любой такой анализ признать использованием произведения, правообладатели фактически могут получить контроль не только над копированием своего контента, но и над обработкой содержащейся в нем информации, полагает эксперт.

«В России основой регулирования являются законодательные нормы, а судебная практика не обладает таким же прецедентным значением. Поэтому в дальнейшем объем допустимого использования произведений для обучения ИИ в России может изменяться прежде всего посредством развития законодательства и подзаконного регулирования, а также через его судебное толкование»,— резюмирует Вадим Ткаченко.

Мария Арялина

Новости компаний Все