advanced
Operational cost
Включайте monitoring, incident response, security patching, capacity planning, on-call load и platform expertise в architecture cost.
Архитектурные решения несут постоянные затраты: monitoring dashboards, on-call, security patching, capacity planning, incident response и экспертиза для каждого компонента. Microservice, экономящий dev time, но утраивающий pager load, может быть убыточным.
Учитывайте toil, mean time to recovery и bus factor для нишевой инфраструктуры (Kafka, service mesh, custom operators).
На интервью: оцените operational cost вместе с dev velocity; объясните, что упростите при burnout on-call.
Типовые ошибки: Kubernetes или mesh без staffing; отсутствие SLO, когда каждый alert pages одинаково; операционная работа «не фича» и не оплачивается.
Чеклист:
- Оцените on-call и runbook burden на компонент.
- Наймите platform expertise или возьмите managed services.
- Связывайте architecture reviews с SLO и incident data.
- Выводите из эксплуатации компоненты, которые дороже пользы.