Эпизод 48.

Мониторинг — это не только про DevOps.
Системный аналитик, который не понимает метрики, рискует написать требования, которые невозможно проверить, выполнить или измерить.
Telegram-канал сообщества: https://t.me/getanalysts
В этом выпуске разбираем мониторинг с точки зрения аналитика:
— что такое метрики мониторинга и откуда они берутся;
— как метрики связаны с нефункциональными требованиями;
— как описывать требования при пиковых нагрузках;
— какие метрики нужны для брокеров сообщений;
— чем отличаются SLO, SLI и SLA;
— что такое четыре золотых сигнала SRE от Google: latency, traffic, errors, saturation.
Отдельно говорим про реальный опыт проекта: как использовались Prometheus, Grafana и Kibana, и почему аналитику важно понимать, что именно команда будет мониторить при проблемах в продакшн.
Выпуск будет полезен системным и бизнес-аналитикам, которые работают с нефункциональными требованиями, интеграциями, архитектурой, брокерами сообщений, API и вопросами надёжности систем. Заберёте для себя много полезных примеров НФТ.
RuTube
VK
YouTube
Если плеер YouTube не запускается, необходимо включить VPN, либо переключиться на другой плеер (вкладки сверху).
Тайм-коды эпизода:
00:00 | Введение
00:18 | Почему нужно знать про метрики мониторинга системным аналитикам
01:47 | Что такое метрики мониторинга
05:03 | Нефункциональные требования, влияющие на мониторинг
09:15 | Этапы работы аналитика с метриками мониторинга
12:20 | Ключевые метрики мониторинга и их источники
14:18 | Детальный разбор каждой метрики мониторинга
18:59 | Загрузка CPU и требования при пиковых нагрузках
21:01 | Метрики мониторинга для брокеров сообщений
23:02 | Метрики SLO, SLI и SLA
26:21 | Инструменты для мониторинга: опыт реального проекта
31:44 | Золотые сигналы SRE от Google
34:10 | Итоги и чек-лист
Метрики — это количественные показатели, отображающие фактическое состояние системы в цифрах (время отклика, ошибки, загрузка ресурсов). Они переводят абстрактное «быстро/надежно» в конкретные значения.
Важно собирать данные с каждого компонента системы: сервиса, frontend, базы данных (БД) и брокера сообщений.
А. Производительность (Performance)
Б. Ресурсы (Infrastructure)
В. Очереди и Брокеры (Kafka/RabbitMQ)
Если вы только начинаете внедрять мониторинг, сфокусируйтесь на этих четырех показателях, которые покрывают 90% проблем:
1. Общий вид - вход в Grafana

2. Список дашбордов внутри Grafana


3. Пример дашборда Grafana: мониторинг сервиса

4. Пример дашборда Grafana: мониторинг хранилища s3

5. Пример дашборда Grafana: мониторинг брокера

Подкаст
5 метрик мониторинга, которые решают 80% проблем
https://getanalyst.ru/podcast/monitoring
✔️ Чек-лист местрик мониторинга с примерами НФТ
✔️ Презентация к эпизоду
Получайте полезные материалы и учитесь новому каждый день в наших социальных сетях.
*Instagram и LinkedIn — запрещенные на территории РФ организации
Мы используем файлы cookie, для персонализации сервисов и повышения удобства пользования сайтом. Если вы не согласны на их использование, поменяйте настройки браузера.