Реляционные СУБД вглубь, NoSQL и кэши, аналитические и поисковые движки, брокеры сообщений и стриминг, пакетная обработка на Spark, работа с данными из приложения: пулы, ORM, миграции
Реляционные СУБД
Индексы и планы запросов, статистика, MVCC и vacuum, уровни изоляции на практике, блокировки и дедлоки, партиционирование, репликация и отставание реплик, шардирование
NoSQL и кэши
Redis и структуры данных, вытеснение и персистентность, стратегии кэширования и лавина промахов, документные и широких колонок хранилища, модели консистентности
Аналитика и поиск
Колоночные хранилища и ClickHouse, OLAP против OLTP, форматы данных, полнотекстовый поиск и Elasticsearch, векторные индексы, объектные хранилища
Брокеры и стриминг
Kafka вглубь: партиции, оффсеты, гарантии доставки; RabbitMQ, NATS и SQS; идемпотентность и дедупликация, DLQ, реестр схем, CDC и outbox, стриминговая обработка
Данные из приложения
Пулы соединений и PgBouncer, N+1 и ORM, миграции без простоя, кэш-инвалидация, транзакции на уровне сервиса, тестирование с базой
Пакетная обработка: Spark
Когда Spark оправдан, устройство приложения и ленивые вычисления, партиции и shuffle, Catalyst и чтение планов, перекос данных, стратегии джойнов и адаптивное выполнение, память исполнителя, цена Python UDF, запись и мелкие файлы, кэширование, Spark Connect