intermediate
RED-метрики
Отслеживайте rate запросов, ошибки и duration для request-driven сервисов и API.
RED (Rate, Errors, Duration) подходит request-driven сервисам: API, gateway и serverless handlers. Отвечает на вопросы: сколько трафика, как часто сбои и насколько медленно для вызывающих.
| Буква | Идея метрики | |-------|--------------| | Rate | Запросов в секунду (или событий в минуту) | | Errors | Неуспешные / всего (по status или outcome) | | Duration | Распределение latency (p50, p95, p99) |
// conceptual counters/histograms
http_requests_total.inc({ method, route, status });
http_request_duration_ms.observe({ route }, elapsed);
Срезы по route, method и dependency только при ограниченной cardinality. Сочетайте RED с SLO по доступности и перцентилям latency, которые чувствует пользователь.
На интервью: buckets гистограмм, определение error (только 5xx vs бизнес-провалы) и RED vs USE для узла БД.
Типовые ошибки: high-cardinality route (сырые ID); среднее latency вместо перцентилей; 4xx как service errors без контекста.
Компромисс — полезность дашбордов против cardinality labels и стоимости хранения.
Чеклист:
- Rate, errors, latency по ключевым поверхностям.
- Гистограммы или summaries для duration.
- Определение error согласовано с SLO.
- Ограничение cardinality labels.