intermediate

Метрики

Измеряйте поведение сервиса counters, gauges, histograms и SLI во времени — для алертов и планирования ёмкости.

Метрики суммируют поведение во времени: counters, gauges, histograms и rates. Питают SLI, планирование ёмкости, алерты и поиск регрессий после deploy.

| RED (сервисы) | USE (ресурсы) | |---------------|---------------| | Rate | Utilization | | Errors | Saturation | | Duration | Errors |

					httpRequestDuration.observe(
  { method: 'GET', route: '/api/orders', status: '200' },
  elapsedSeconds,
);
				

Контролируйте cardinality labels — не кладите неограниченные user ID в labels метрик.

На интервью: перцентили latency, error rate, saturation, RED/USE, лимиты cardinality и почему средние скрывают tail latency.

Типовые ошибки: high-cardinality labels перегружают системы; дашборды без SLO не используются.

Компромисс — детализация метрик против стоимости хранения и шума алертов.

Чеклист:

  • Latency, errors, traffic, saturation.
  • Контроль cardinality labels.
  • Метрики привязаны к SLO и ownership.
  • Сравнение окон deploy на регрессии.