intermediate
Метрики
Измеряйте поведение сервиса counters, gauges, histograms и SLI во времени — для алертов и планирования ёмкости.
Метрики суммируют поведение во времени: counters, gauges, histograms и rates. Питают SLI, планирование ёмкости, алерты и поиск регрессий после deploy.
| RED (сервисы) | USE (ресурсы) | |---------------|---------------| | Rate | Utilization | | Errors | Saturation | | Duration | Errors |
httpRequestDuration.observe(
{ method: 'GET', route: '/api/orders', status: '200' },
elapsedSeconds,
);
Контролируйте cardinality labels — не кладите неограниченные user ID в labels метрик.
На интервью: перцентили latency, error rate, saturation, RED/USE, лимиты cardinality и почему средние скрывают tail latency.
Типовые ошибки: high-cardinality labels перегружают системы; дашборды без SLO не используются.
Компромисс — детализация метрик против стоимости хранения и шума алертов.
Чеклист:
- Latency, errors, traffic, saturation.
- Контроль cardinality labels.
- Метрики привязаны к SLO и ownership.
- Сравнение окон deploy на регрессии.