Баста, карапузики! Экспроприация грядет.
Автор: НиколайПри обучении нейросетей модели «проглатывают» огромные массивы данных — тексты, изображения, музыку. Часто в эти наборы попадают произведения, защищённые авторским правом. Возникает дилемма: считается ли такое использование нарушением, если цель — не скопировать текст дословно, а «научить» модель выявлять закономерности, стили, паттерны? И писать, как авторы?
С точки зрения классического авторского права (в том числе российского) использование объекта без согласия правообладателя — это нарушение. Статья 1270 ГК РФ даёт автору исключительное право решать, как и в каких целях использовать произведение. Обучение ИИ под это подпадает, поэтому по общему правилу нужно договариваться.
А как сейчас в законе?
В России ситуация сложилась так: в 2026 году приняли закон о развитии ИИ. В нём закрепили, что разработчики могут обучать модели на произведениях, если получили их правомерно (купили экземпляр или автор сам предоставил доступ) либо если контент был в открытом доступе. При этом выплата вознаграждения авторам не предусмотрена — закон не обязывает разработчиков платить.
Именно это и вызвало волну критики со стороны творческого сообщества. Писатели, художники и другие авторы указывали: российские модели получают данные фактически бесплатно, что снижает мотивацию создавать новое. Появляются и новые инструменты. Например, создаются платформы, которые позволяют авторам самим решать, разрешать ли использование их работ для обучения ИИ, и автоматически получать плату при таком использовании. Также обсуждается модель с организацией по коллективному управлению правами: она заключает единый договор с разработчиками, собирает платежи и распределяет их между правообладателями в дальнейшем.
Вывод
По букве закона в России сейчас разработчики не обязаны платить автоматически — достаточно правомерного получения контента. В других юрисдикциях подходы тоже различаются: где-то есть специальные исключения для анализа данных (например, директива ЕС о TDM), где-то упор делается на рыночное лицензирование.В Европейском союзе, в частности, в Директиве 2019/790/ЕС «Об авторском праве и смежных правах в рамках единого цифрового рынка», закреплён специальный режим для Text and Data Mining (TDM). Под TDM понимается автоматизированный анализ текста и данных в цифровой форме для выявления закономерностей, тенденций и корреляций.
Директива предусматривает две модели регулирования в зависимости от целей анализа:
- Статья 3 вводит обязательное исключение для научно-исследовательских организаций и учреждений культурного наследия. В этом случае правообладатели не могут препятствовать использованию TDM при условии, что доступ к материалам был правомерным (включая общедоступный контент в интернете).Важный нюанс: коммерческие исследовательские организации из-под действия статьи 3 исключены. Однако, проверка наличия запрета правообладателя технически сложна из-за отсутствия единых стандартов выражения таких запретов.
- Статья 4 устанавливает общее исключение: воспроизведение и извлечение данных для TDM возможно, если правообладатель прямо не заявил о запрете на такую деятельность (в том числе машиночитаемыми способами для контента в открытом доступе).В США, напротив, упор делается на рыночное лицензирование — добровольное соглашение между правообладателем и пользователем. Здесь нет специальных законодательных исключений для TDM, вместо этого действует принцип: любое использование охраняемого объекта требует согласия правообладателя, которое оформляется через лицензионный договор.
Информация:
Госдума приняла во втором и третьем чтениях закон «О поддержке развития технологий искусственного интеллекта в РФ». Документ закрепляет базовые термины и принципы регулирования. В нем определены понятия «искусственный интеллект», «большая фундаментальная модель» (с порогом от 1 млрд параметров), «состав данных» и «разработчик».
Документ описывает две категории ИИ-моделей: суверенная (должна быть разработана на всех этапах только российским юрлицом и работать только на инфраструктуре РФ) и национальная (в существенной степени разработана российским юрлицом, но ее компоненты могут включать решения с открытым исходным кодом). Указано, что модели обязаны соответствовать российскому законодательству и «традиционным духовно-нравственным ценностям».
Правительство получило право устанавливать случаи, в которых допускается применение исключительно «суверенных» или «национальных» моделей ИИ (в банковской сфере — по согласованию с ЦБ), а также вводить требования по предотвращению рисков в отраслях.
Владельцы сервисов, предоставляющих доступ к большим моделям, обязаны уведомлять пользователей о принадлежности прав на результаты интеллектуальной деятельности, полученные с помощью ИИ, и об условиях их использования и сохранения.
Корректировки, внесенные в законопроект ко второму и третьему чтениям, носят преимущественно уточняющий характер. Они коснулись терминологии и детализации процедурных моментов. Из предмета регулирования исключили слово «использование», оставив только «разработку, внедрение и применение». В целях закона вместо «инновационной экономики» появилась «цифровая экономика», а к государственному управлению добавили муниципальный уровень. В понятийном аппарате «набор данных» заменили на «состав данных», «настройку» параметров — на «подбор», а определение российского юридического лица переместили в статью о статусах моделей.
Чуть более заметные изменения затронули статусы моделей в технических нюансах. Так, из требования к «суверенной» модели убрали обязательную «матрицу исходных коэффициентов», оставив лишь «обучение». Существенное расширение функций получили уполномоченные органы (правительство и в ряде случаев ЦБ). Ранее они стимулировали только применение больших моделей, теперь же полномочия распространены на «разработку, внедрение и применение».
Заметные изменения претерпела норма о маркировке ИИ-контента.
Если в первом чтении обязанность обеспечивать возможность маркировки лежала на владельцах социальных сетей, то ко второму чтению круг ответственных лиц расширили до всех владельцев крупных интернет-платформ, то есть сайтов, информационных систем и программ с суточной аудиторией свыше 500 тыс. пользователей. При этом сама маркировка осталась добровольной для пользователей, а платформы теперь не просто «обеспечивают» возможность маркировки, а «обязаны обеспечивать».
Статья 10, разрешающая использовать объекты авторского права для обучения ИИ без согласия правообладателей, практически не изменилась: уточнили лишь, что произведение должно быть «доведено до всеобщего сведения и доступно для анализа», убрав разделительный союз «или» для единообразия.