intermediate

CloudWatch

Собирайте логи, метрики, алармы, дашборды и события для AWS workloads, управляя retention, cardinality и шумом алертов.

CloudWatch собирает метрики, логи, алarmы и события для нагрузок AWS. Node.js-сервисы на Lambda, ECS или EC2 пишут структурированный JSON в stdout; агент или платформа доставляет их в log groups с политикой retention.

| Сигнал | Инструменты | |--------|-------------| | Metrics | Свои namespaces, EMF из Lambda, встроенные метрики AWS | | Logs | Log groups, metric filters, запросы Logs Insights | | Alarms | Действия SNS/Auto Scaling по порогам | | Dashboards | Сквозной операционный обзор |

Следите за cardinality: высококардинальные labels в custom metrics раздувают счёт. SLO-driven алarmы (error rate, latency p99, возраст очереди) лучше, чем пейджинг на каждый всплеск CPU.

На интервью: основы Logs Insights, metric filters vs embedded metric format, composite alarms и чем CloudWatch отличается от APM вроде X-Ray или сторонних стеков.

Типовые ошибки: бесконечный retention логов; секреты и PII в логах; алarmы без runbook; только дефолтные метрики AWS при невидимых ошибках приложения.

Компромисс — нативная интеграция и низкий порог входа против ограниченной глубины tracing и ergonomics запросов по сравнению со специализированным observability.

Чеклист:

  • Структурированные логи с request ID и именем сервиса.
  • Retention логов по окружениям.
  • Алarmы по симптомам для пользователя, не только по CPU.
  • Dashboards связаны с runbook on-call и SNS.