Всё чужое: кому выгодно и сколько стоит обучать ИИ в РФ
Российских разработчиков ИИ могут обязать платить правообладателям за использование контента для обучения моделей, как сообщает Хабр.
Цена вопроса — неподъёмный объём потенциальных отчислений, которые лягут в себестоимость каждой сгенерированной картинки или текста.
Выгодоприобретатели — крупные медиахолдинги и агрегаторы, годами собиравшие базы данных. Для них это скрытый налог на конкурентов: если стартап должен платить за каждое слово, его маржинальность (разница между ценой и затратами) падает до нуля. Мелкие игроки вроде разработчика Ивана Брагина, вложившего сбережения в обучение узкой модели на медицинских статьях, рискуют остаться без ликвидности — живых денег для расчётов с правообладателями.
Во-первых, лицензирование контента создаст бюрократический барьер, где вместо кода программисты будут согласовывать права. Во-вторых, отчисления станут рентой для посредников, которые сами бесплатно скачали чужие тексты из интернета. В-третьих, ROI (окупаемость вложений) в ИИ-стартапы рухнет, так как переменные издержки на датасеты сделают выпуск моделей нерентабельным.
Парадокс в том, что те же медиахолдинги годами бесплатно публиковали статьи в сети ради кликов и рекламы. Теперь они требуют ретроактивной платы за контент, который сами же отдали в открытый доступ. Эта система создана намеренно: монополисты используют копирайт не для защиты авторов, а как инструмент регуляторного убийства потенциальных технологических конкурентов.