Day 2 Operations: Как ломалась и крепла архитектура MWS Cloud на базе K8s и SaltStack
Год назад Иван Гулаков из MWS Cloud сорвал овации на DevOops, показав потрясающий инженерный паттерн: они превратили Kubernetes в единый Control Plane для железных серверов, скрестив кастомные Go-операторы и агентскую мощь SaltStack. На слайдах архитектура выглядела безупречно. Это был классический Day 1 — проектирование и запуск.
Но настоящая инженерия куется не на доске архитектора, а в 3 часа ночи под вой алертов. И в этом году Иван пришел с докладом «Ломаться или становиться сильнее: зарисовки инцидентов с k8s». Это значит, что прошел год сурового продакшена, и пора обсудить самое интересное: как эта идеальная схема горела, падала и эволюционировала.
Мы решили позвать Ваню в прямой эфир, чтобы устроить честный разбор полетов и поговорить о Day 2 Operations. Обсудим, как спроектированная год назад система повела себя в суровом продакшене публичного облака и какую цену пришлось заплатить за кастомную разработку.
7 августа 2026 в 18:00 (МСК) встречаемся в эфире на настоящий инженерный постмортем!
😉 YouTube | 📺 VK Видео
Будем жестко и откровенно обсуждать:
🪦 Смерть Immutable Infrastructure? (Боль идеалиста)
Разберем холиварную тему. Как быть, когда бизнес-требования ломают «книжную» архитектуру и заставляют возвращаться к Mutable? Правда ли, что концепция Immutable работает только до тех пор, пока ты не начинаешь считать деньги на облачных масштабах?
🔨 K8s как молоток, а весь мир - гвоздь (Истинная цена «дешевой» инфры)
Зачем тянуть K8s API, etcd и писать кастомные Go-операторы для серверов вне кластера? Обсудим скрытую цену разработки (TCO) таких «умных» костылей.
🧟♂️ Некромантия или прагматизм: Почему SaltStack?
В мире, где балом правит Ansible, а для декларативщины есть Terraform, выбор SaltStack вызывает вопросы. Оправдываем этот стек: почему на тысячах узлов агентская модель оказалась единственным выходом.
💥 Blast Radius (Радиус поражения) и ночные кошмары
Самый страшный сон SRE: кастомный K8s-контроллер сходит с ума (кривой reconciliation) и начинает раскатывать ошибку на весь дата-центр. Как они спасают железо от собственной автоматизации?
🤝 Platform Engineering и внутренний заказчик
Разрабатывать платформу для других DevOps-инженеров — задача со звездочкой. Как выглядит интерфейс платформы, как борются с хотелками коллег и выстраивают процессы.
🐥 Факапы и мертвые канарейки
Год назад все восхищались зональными выкатками. В этот раз поговорим о боли: как баги маскируются на canary-узлах, просачиваются в бой и почему канареечные релизы для инфры — не панацея.
Подкаст пройдет в формате «встречи ветеранов SRE у костра». Будем говорить про реальную эксплуатацию, Blameless-культуру и выживание в проде. Готовьте свои самые каверзные вопросы!