Продолжается война между авторами и владельцами LLM. В РФ снова обсуждают новый механизм защиты авторских прав при обучении нейросетей.
По проекту поправок правообладатель сможет запретить использование своих произведений для обучения ИИ, разместив соответствующее уведомление на своём сайте или на официальном ресурсе организации по управлению правами.
Ранее предполагалось размещать такую отметку на самом произведении или связанном с ним ресурсе. Теперь обсуждается более централизованный вариант.
ИТ-компании, наоборот, считают, что проверять миллиарды объектов по отдельной базе запретов технически сложно и это может сильно замедлить обучение моделей.
Их предпочтительный вариант - машиночитаемый запрет непосредственно на источнике, который система сможет автоматически распознать.
как дать автору реальный способ запретить обучение на своём контенте, но при этом не превратить подготовку датасетов в огромную бюрократическую процедуру.
И от выбранной модели будет зависеть не только защита правообладателей, но и себестоимость, и скорость разработки российских ИИ-моделей.