Доставка фронтенда до пользователя, платформенная эксплуатация кластера, мониторинг на Prometheus и Grafana и инфраструктура AI и ML: то, что живёт между кодом сервиса и облачными примитивами
Доставка фронтенда
Сборка и бюджеты бандла, версионирование ассетов и кэш-заголовки, атомарный деплой, RUM и Core Web Vitals, мониторинг браузерных ошибок, локали на CDN, постепенная выкатка, безопасность доставки
Платформа и эксплуатация
Сеть и DNS в кластере, сетевые политики, планировщик и размещение подов, безопасность контейнера в рантайме, квоты и мультиарендность, отладка в проде, задачи и расписания, бэкапы, обновление кластера
Инфраструктура AI и ML
GPU в кластере и планирование задач, распределённое обучение и контрольные точки, хранение датасетов и весов, стоимость и утилизация, холодный старт моделей, кэш ответов, изоляция данных, деградация AI-функции
Prometheus и метрики
Модель pull и модель данных, типы метрик и PromQL, service discovery и релейблинг, экспортеры и инструментирование, гистограммы и перцентили, устройство TSDB, кардинальность, правила и Alertmanager, долгое хранение и работа пары в проде
Grafana и дашборды
Источники данных и режим proxy, панели и визуализации, устройство дашборда и переменные, повторение и преобразования, единицы и пороги, $__rate_interval, Grafana Alerting, provisioning и права доступа, производительность дашборда, exemplars и динамические дашборды