intermediate

RED-метрики

Отслеживайте rate запросов, ошибки и duration для request-driven сервисов и API.

RED (Rate, Errors, Duration) подходит request-driven сервисам: API, gateway и serverless handlers. Отвечает на вопросы: сколько трафика, как часто сбои и насколько медленно для вызывающих.

| Буква | Идея метрики | |-------|--------------| | Rate | Запросов в секунду (или событий в минуту) | | Errors | Неуспешные / всего (по status или outcome) | | Duration | Распределение latency (p50, p95, p99) |

					// conceptual counters/histograms
http_requests_total.inc({ method, route, status });
http_request_duration_ms.observe({ route }, elapsed);
				

Срезы по route, method и dependency только при ограниченной cardinality. Сочетайте RED с SLO по доступности и перцентилям latency, которые чувствует пользователь.

На интервью: buckets гистограмм, определение error (только 5xx vs бизнес-провалы) и RED vs USE для узла БД.

Типовые ошибки: high-cardinality route (сырые ID); среднее latency вместо перцентилей; 4xx как service errors без контекста.

Компромисс — полезность дашбордов против cardinality labels и стоимости хранения.

Чеклист:

  • Rate, errors, latency по ключевым поверхностям.
  • Гистограммы или summaries для duration.
  • Определение error согласовано с SLO.
  • Ограничение cardinality labels.