advanced

Operational cost

Включайте monitoring, incident response, security patching, capacity planning, on-call load и platform expertise в architecture cost.

Архитектурные решения несут постоянные затраты: monitoring dashboards, on-call, security patching, capacity planning, incident response и экспертиза для каждого компонента. Microservice, экономящий dev time, но утраивающий pager load, может быть убыточным.

Учитывайте toil, mean time to recovery и bus factor для нишевой инфраструктуры (Kafka, service mesh, custom operators).

На интервью: оцените operational cost вместе с dev velocity; объясните, что упростите при burnout on-call.

Типовые ошибки: Kubernetes или mesh без staffing; отсутствие SLO, когда каждый alert pages одинаково; операционная работа «не фича» и не оплачивается.

Чеклист:

  • Оцените on-call и runbook burden на компонент.
  • Наймите platform expertise или возьмите managed services.
  • Связывайте architecture reviews с SLO и incident data.
  • Выводите из эксплуатации компоненты, которые дороже пользы.