Перейти к содержимому
7 / 10

Многомерные ряды: как отличить общий сдвиг от поломки одной метрики?

Когда метрик сотни, поточечные детекторы на каждой дают лавину алертов: один инцидент двигает разом двадцать графиков. Нужна структура. Первый приём — отделить общее от частного: выделить главные компоненты по истории, и тогда «весь трафик просел на 20%» окажется движением первой компоненты, а «просела только оплата картой в Германии» — большим остатком после вычитания компонент. Второй — следить за корреляциями, а не только за уровнями: пара метрик, которая годами двигалась синхронно, разошлась — это аномалия, даже если обе внутри своих коридоров. Третий — иерархия и агрегаты: сначала детектируем на верхнем уровне (общая выручка), затем спускаемся по разрезам, чтобы найти виновный сегмент, а не алертить по всем сразу. Практический результат — один алерт с указанием слоя и разреза вместо двадцати одинаковых сообщений.

Многомерные ряды: как отличить общий сдвиг от поломки одной метрики? | JScriptiser