Свежая работа MIT по machine unlearning обнаружила интересный эффект: с ростом обучающего датасета связь между отдельными примерами и поведением модели становится менее очевидной.
На практике это означает:
— удалить конкретный пример из обучения ≠ гарантированно убрать его влияние на модель;
— становится сложнее определить, какие данные повлияли на конкретный ответ;
— «право на забвение» технически становится сложнее реализовать для больших моделей.
Для unlearning это неприятный вывод: масштабирование модели и датасета не делает задачу удаления данных автоматически проще.
📍 Навигация: Вакансии • Задачи • Собесы


