Автоэнкодер как детектор: почему ошибка реконструкции работает и когда она обманывает?
Автоэнкодер сжимает вход в узкое представление и восстанавливает обратно. Обучившись на норме, он хорошо восстанавливает типичное и плохо — нетипичное, поэтому ошибка реконструкции служит скором аномальности. Работает это, пока выполняются два условия: обучающая выборка чистая и «бутылочное горлышко» действительно узкое. Оба нарушаются легко. Слишком ёмкая сеть выучивает тождественное отображение и восстанавливает аномалии не хуже нормы — скор схлопывается. Аномалии в обучении выучиваются как норма — детектор молчит именно на том, что уже видел. Дополнительная ловушка: ошибка реконструкции неоднородна по признакам, у величин с большим размахом она всегда больше, поэтому без нормировки скор определяется одним-двумя столбцами. Практика: узкий код (обычно 5–20% входа), denoising-режим, регуляризация, покомпонентная нормировка ошибки и обязательная проверка, что скор различает норму и известные инциденты.