13 / 15
Как устроено автомасштабирование в Kubernetes: HPA, VPA, автомасштабирование узлов, KEDA?
HPA меняет число подов по метрике (CPU, память или произвольная — например, длина очереди или запросы в секунду), сравнивая текущее значение с целевым. VPA подбирает requests и limits для пода, но в паре с HPA по той же метрике конфликтует. Cluster Autoscaler / Karpenter добавляет и убирает узлы, когда подам некуда встать или узлы простаивают. KEDA расширяет HPA внешними источниками событий (очереди, Kafka, брокеры) и умеет масштабировать до нуля. Работает эта цепочка только при корректных requests, готовности подов и запасе по времени: масштабирование занимает секунды-минуты, поэтому пиковые всплески закрывают ещё и очередями и кешем.