Свободные нейросети: как будут «воспитывать» искусственный интеллект

Вопрос защиты авторских прав при обучении систем ИИ вышел на самый высокий уровень. Президент РФ поручил рабочей группе при Совете по кодификации и совершенствованию гражданского законодательства подготовить конкретные предложения к концу сентября 2026 года. Задача — устранить фундаментальные противоречия между недавно принятым законом об ИИ и действующим Гражданским кодексом. Почему эти разногласия появились и к чему они могут привести, читайте в материале «Сферы».
Время прочтения: 10 минут

Основная проблема заключается в норме принятого Федерального закона № 243-ФЗ об искусственном интеллекте. Документ вводит специальное исключение для обучения так называемых суверенных и национальных фундаментальных моделей. Как поясняет Никита Вторушин, CTO EdTech og1.ru / biorich.com, CEO «Fast-Notes», речь идет о специальном исключении для определенного класса фундаментальных российских моделей. 

«Фактически получение этого статуса дает разработчикам моделей право использовать для обучения часть чужого защищенного контента без индивидуального согласия», — поясняет он.

Норма вступает в силу с 1 марта 2027 года и разрешает компьютерный анализ авторских материалов, если они были получены правомерно либо опубликованы и доступны без технических ограничений. Однако, как подчеркивает Константин Лучников, партнер, юрист адвокатского бюро «Этлегис», норма вызывает противоречия.

«Она затрагивает исключительное право автора разрешать использование контента: открытый доступ к тексту, фото или музыке не равен согласию на коммерческое обучение модели», — отмечает Константин Лучников.

С ним солидарна Мария Полунина, основатель и руководитель юридического агентства «Silver Knight»: «Проблема в том, что, если произведение выложено в открытый доступ, это еще не значит, что его разрешили бесплатно использовать в любых целях. А автору сегодня почти невозможно узнать, попала ли его работа в обучающую базу».

Еще один важный аспект отмечает Валерий Сидоренко, член Общественного cовета при Минцифры России, руководитель Рабочей группы по выработке подхода к регулированию контента, созданного с применением ИИ. По его словам, депутаты предложили причислять к нейроконтенту текст.

«Это недопустимо: пока не существует надежных методов определения происхождения текста, а необходимость отсканировать весь имеющийся на сайте или в соцсети текст, чтобы разделить его на "нейросетевой" и "человеческий" для выполнения этого закона, — чрезмерная нагрузка на бизнес», — поясняет Валерий Сидоренко.

Позиция правообладателей

Представители творческих индустрий и правообладатели настаивают на внесении системных поправок. Среди их требований — понятные правила лицензирования. Использование охраняемых произведений для обучения нейросетей должно быть прямо признано в ГК как отдельный способ использования.

Кроме того, правообладатели говорят о важности разработки прозрачного механизма определения источников обучения. Они хотят знать, какие именно произведения используются в обучающих датасетах.

«На мой взгляд, правила должны быть понятны обеим сторонам: разработчик раскрывает источники, автор может запретить использование, а за ценный профессиональный контент получает вознаграждение», — рассказывает Мария Полунина.

Константин Лучников добавляет, что главная сложность для правообладателей сегодня — это непрозрачность датасетов: «Коллизия с подходом статьи 1229 ГК РФ и непрозрачность датасетов затрудняют правообладателю обнаружение использования контента и защиту своих прав».

История промтов

Другой важный нюанс состоит в определении той тонкой грани, где произведение является объектом авторского права, а где — нет, особенно если оно сделано при помощи нейросетей. Ведь законодательство пока не дает четких определений критериев авторства при создании контента с помощью ИИ. Никита Вторушин предлагает не пытаться считать проценты, что сделал человек, а что ИИ, — такой критерий практически невозможно объективно применить.

«Смотреть нужно на количество и качество самостоятельных творческих решений человека. Если человек придумал концепт, сюжет, композицию, персонажей, то вклад очевиден. Если же запрос был "Нарисуй красивый закат" и взял первый вариант, то тут все ясно», — считает он.

Мария Полунина согласна с этим подходом: «Творческий вклад человека стоит оценивать не по количеству промптов, а по его решениям: придумал ли он концепцию, отбирал и дорабатывал ли результат».

Сергей Щербаков уверен, что стоит придерживаться бинарной логики: «Либо там есть творческая переработка результата человеком, но тогда это не ИИ-контент, а творчество автора. Либо же это сырой ответ без доработки, но тогда это и контентом назвать нельзя, это будет просто генерация ИИ-модели».

И тут появляется один важный момент — а как доказать, что человек вкладывал свои идеи в произведение ИИ? Артём Демидов, основатель AI-студии AINEX LAB, преподаватель в НГТУ, Skypro и Znania, предлагает следующий выход из ситуации: «Здесь может появиться совершенно новый практический навык, где авторам придется сохранять историю промптов и промежуточные варианты, файлы или историю, чтобы доказать их творческий вклад и признать авторство».

Возможные модели регулирования

Понимая все эти аспекты, рабочая группа при Совете по кодификации должна представить свои предложения к концу сентября. Сейчас обсуждается несколько вариантов решения проблемы.

Как отмечает Алексей Мартыненко, CEO «Zethereum», главный редактор «SPVNews», web-разработчик «Signumcoin», «обсуждаемая модель не разрешительная, а через единый реестр: правообладатель сможет запретить использование конкретных работ, по умолчанию согласие предполагается».

По мнению Никиты Вторушина, рынок придет к гибридной системе. «Фотография из профессионального фотобанка, архив крупного СМИ и сообщение в открытом блоге — экономически очень разные объекты, и пытаться регулировать их абсолютно одинаково будет сложно», — уверен он.

Сергей Щербаков, руководитель отдела данных и машинного обучения компании «ICL Services», считает, что механизм будет напоминать пресловутые отчисления от средств хранения (флешки, диски и т.п.) в пользу Российского Союза Правообладателей (РСП).

«Вопрос — будет ли этот сбор браться превентивно со всех разработчиков или по факту использования обученной нейросети? Логичнее скорее брать сбор с результатов деятельности, но боюсь, что у нас захотят брать сбор со всех», — говорит Сергей Щербаков.

Константин Лучников отмечает, что свежая версия поправок должна предполагать право автора публично запретить обучение на его произведении (механизм Opt-out): «При отсутствии запрета — возможность использования, но с обязательной разовой компенсацией от любого разработчика ИИ, если нет договора о бесплатном использовании».

При этом Юрий Анищенко, основатель креативного инфлюенс-агентства «Ромашка Медиа», надеется, что для крупных баз появится единая лицензия через посредника. Ведь иначе это будут тысячи отдельных договоров.

«Важно, чтобы цена и условия зависели от типа контента и масштаба его использования», — добавляет он.

Успеть до марта

Для бизнеса последствия нововведений окажутся неоднородными. И коснутся они не только разработчиков ИИ, но и правообладателей. Относительно первых Никита Вторушин предупреждает о разделении рынка на два уровня.

«Если компания обучает собственную узкую модель, но у ее модели нет статуса национальной или суверенной большой фундаментальной сети, она не получает ту же льготу. То есть фактически рынок поделится на два уровня: у крупных моделей более простой юридический доступ, а у небольших — обычные правила авторского права», — считает он.

По словам Артёма Демидова, сейчас время заработало против правообладателей. «До марта 2027 года есть окно, чтобы заранее зафиксировать запрет на использование своего контента. Кто им не воспользуется, будет защищать права поштучно и в суде», — говорит он.

Юрий Анищенко уверен, что разработчикам придется внимательнее относиться к происхождению обучающих данных и уметь объяснить, на каком основании они использовались.

«Я в работе с цифровым контентом регулярно сталкиваюсь с тем, что спор начинается именно тогда, когда никто заранее не зафиксировал источник материала и правила его использования. Поэтому прозрачность здесь важнее формального запрета или полного разрешения», — рассказывает он.

Осталось дождаться предложений от рабочей группы, которые должны появиться к концу сентября. Посмотрим, удастся ли найти баланс между развитием технологий ИИ и защитой интересов авторов и творческих индустрий. Но уже ясно, что сегодня данные перестают быть просто техническим сырьем и становятся отдельным объектом регулирования и торговли.

От того, насколько удачно рабочая группа сможет синхронизировать нормы Гражданского кодекса и закон об ИИ, зависит не только баланс интересов авторов и разработчиков, но и сама возможность России сохранить конкурентоспособность в гонке генеративных моделей без создания правового хаоса.

Изображение создано Magnific, www.magnific.com 

Рекомендуем

Статья

Авторский запрет для ИИ и рекордные погашения долгов: главные новости уходящей недели

Бездомные кошки «выиграли» суд у управляющей компании. Минцифры попросило провайдеров выделить отдельные IP-подсети для сайтов из «белого списка». Правообладатели смогут запретить использование своего контента для обучения ИИ. Об этих и других событиях — в еженедельном дайджесте «Сферы».

Статья

Защита адвокатов и чипы для ИИ: главные новости уходящей недели

Минцифры пересмотрело «Антифрод 3.0». Контент, созданный нейросетями, обяжут маркировать. Роспотребнадзор проверил готовность школ к новому учебному году. Об этих и других событиях — в еженедельном дайджесте «Сферы».

Авторский взгляд

ИИ вместо младшего юриста? Какие задачи уже сегодня забирают алгоритмы

ИИ уже умеет выполнять значительную часть задач, с которых начинается работа младшего юриста: искать нужные положения в документах, сверять реквизиты, извлекать сроки и суммы, работать с версиями и собирать черновики. Но автоматизация рутины не отменяет главного — решения и ответственности за него. Какие задачи уже отдают ИИ, где он может ошибиться и что всё равно остаётся за юристом, рассказывает Тим Зинин, управляющий партнёр компании «Зинин, Штурбин и партнёры».

Нужно хоть что-то написать