Российский ИТ-бизнес выступил против платы за контент для обучения ИИ
Российский ИТ-бизнес выступил против платы за контент для обучения ИИ Продолжается спор о том, должен ли разработчик нейросети платить правообладателям за использование общедоступных произведений при обучении моделей. ▫️ Ассоциация больших данных («Сбер», «Яндекс», «Авито», «Ростелеком», VK, HH) и Альянс в сфере ИИ выступили против обязательного вознаграждения. Они считают, что механизм в таком виде технически нереализуем и создаст дополнительные расходы для российских разработчиков. ▫️ Главная проблема - масштаб. Чтобы начислить выплату, придется установить, какие именно материалы использовала модель, кому принадлежит каждый объект, действительны ли права, кому перечислять деньги и как учитывать удаление контента, смену правообладателей и условий лицензирования. Для уже обученных моделей ситуация еще сложнее: ретроспективно восстановить состав обучающих датасетов во многих случаях невозможно. Речь идет о миллиардах материалов, часть которых вообще не имеет однозначно устанавливаемого правообладателя. ▫️ В АБД опасаются, что такая система ударит именно по российским разработчикам: появятся дополнительные расходы на обучение и учет данных, а доступный массив информации сократится. В результате могут вырасти цены на отечественные модели и снизиться их конкурентоспособность. ИИ-бизнес предлагает свой вариант правил для авторского контента ▫️ Не брать плату за сам факт использования общедоступной информации. Если данные получены законным способом и находятся в открытом доступе, их машинный анализ для обучения ИИ не должен автоматически создавать обязательство по выплате вознаграждения. ▫️ Не вводить ретроспективные выплаты. Требование платить за контент, который уже использовался при обучении созданных моделей, предлагают исключить. Восстановить состав старых датасетов и установить права на каждый объект во многих случаях технически невозможно. ▫️ Дать правообладателю возможность отказаться. Вместо тотальной системы учета АБД предлагает сохранить механизм opt-out — право ограничить использование своих материалов, но сделать такой отказ понятным и технически реализуемым. ▫️ Закрепить понятие «машинный анализ информации». АБД предлагает отдельно определить его в законодательстве и прямо разрешить такой анализ применительно к обучению ИИ-моделей. Но у правообладателей противоположная логика Публичность произведения не означает автоматического согласия на любое его использование. Представители индустрии также предупреждают о парадоксе, при котором пиратская копия без DRM может оказаться более удобным источником для обучения ИИ, чем легально приобретенный контент. Подписывайтесь на AI для бизнеса