Курс для тех, кто хочет обеспечивать, контролировать и поддерживать надежную работу сервиса. Вы научитесь работать сосвязкой Prometheus+Grafana, разбираться вработе системы ичитать созданные графики.
Познакомьтесь с материалами и спикерами курса. Демодоступ доступен 3 дня.
Начать учиться на курсе по «Мониторинг в Grafana»
Демодоступ к курсу откроется в LMS
Мониторинг отслеживает операции в режиме реального времени и позволяет получать обратную связь о работе приложения.
На курсе вы научитесь
01
Улучшать процесс разработки
А еще:
Выбирать правильные метрики
Строить полезные алерты
Расследовать реальные инциденты
Проектировать систему наблюдаемости
Избегать alert fatigue
Влиять на пользовательский опыт
С помощью мониторинга вы можете отслеживать взаимодействия пользователей с вашим приложением, выявлять и исправлять слабые места, повышать лояльность клиентов и продажи.
02
Сокращать время простоя и минимизировать потери
Мониторинг позволяет быстро обнаружить и исправить проблему в работе системы, прежде чем она приведет к потере доходов или клиентов.
03
Повышать качество кода
С помощью мониторинга вы можете отслеживать частоту и типы ошибок, которые возникают при работе с кодом. Это позволит выявить слабые места и оптимизировать процессы разработки.
04
После курса вы сможете
Видеть проблемы до жалоб пользователей
Находить причины инцидентов за минуты, а не часы
Строить дашборды для бизнеса и инфраструктуры
Настраивать алерты без ложных срабатываний
Контролировать Kubernetes и микросервисы
Уверенно сопровождать production-системы
Если мониторинг настроен плохо
Опроблемах сообщают пользователи
Инциденты расследуются часами
Сложно понять источник ошибки
Алерты шумят и игнорируются
Команда работает в режиме постоянного реагирования
Если мониторинг настроен правильно
Проблемы видны заранее
Инциденты локализуются быстро
Есть единая картина состояния системы
Команда работает предсказуемо
Мониторинг сегодня — это обязательный навык для:
DevOps Engineer
SRE
Platform Engineer
Kubernetes Engineer
Infrastructure Engineer
Какие задачи вы сможете решать
Почему выросло время ответа API
Почему сервис начал потреблять память
Где находится узкое место системы
Почему падают поды Kubernetes
Когда закончится место на диске
Почему пользователи получают ошибки
Что получает компания
Меньше простоев
Быстрое решение инцидентов
Прозрачность работы сервисов
Снижение операционных рисков
Стабильность инфраструктуры
Спикер курса
Head of SRE Process в Dodo Engineering
Начинал карьеру в качестве .NET и Node. js, разработчика
Занимается внедрением культуры SRE в Dodo Engineering
Спикер конференций HighLoad, DevOps Live, DevOops и Podlodka Crew.
1. Blackbox & Whitebox 2. 4 golden signals 3. RED 4. USE
Результат: узнаете подходы к мониторингу и поймёте, чем они различаются. Научитесь выбирать подходы для мониторинга своего приложения
Grafana
Prometheus & Alertmanager
Результат: поймёте, как установить и базово настроить систему мониторинга
Модель данных и типы метрик.
Особенности мониторинга latency
Результат: узнаете виды метрик в Prometheus, чем они различаются и для чего каждый тип предназначен. Разберётесь в особенностях мониторинга latecny
Базовые функции и область их применения
Результат: научитесь взаимодействовать с метриками в динамике и разных состояниях
Создаём первый dashboard
Результат: поймёте, как создавать простой дашборд и выводить на него метрики
Работаем с explorer, query inspector, переменными, data link’ами, override’ами и duplicate options
Результат: научитесь работать с дашбордами на более продвинутом уровне
Создаём алёрты в Prometheus и Grafana, разбираемся, в чём между ними разница
Результат: научитесь создавать алёрты в Grafana и Prometheus. Узнаете преимущества и недостатки обоих типов
Пишем несколько тестов на алёрт, разбираемся с недостатками
Результат: поймёте, зачем нужны тесты, научитесь их писать и интерпретировать результаты, узнаете недостатки тестов
Навыки, которыми нужно обладать
Работать с Docker
Docker-compose
Читать код на Go
Кому подойдет курс
которые обслуживают инфраструктуру, и хотят получить навыки по мониторингу для более стабильной работы системы
Системным администраторам
Разработчикам
которым нужно научиться самостоятельно отвечать за мониторинг своего приложения, выбрать и настроить метрики стабильности без траты времени на чтение документации и остановки кодинга новых фич
которым нужно углубиться в понимание процессов мониторинга. Или нужно оптимизировать загрузку кластера настроить балансировщики на основе сбора метрик в Lens
DevOps-инженерам
Cвидетельство
Именное свидетельство о прохождении курса получает студент, если:
изучил 80% курса
принимал участие в решении практик, которые входят в курс.
Этот курс может оплатить ваша компания
Если вы считаете, что знания, полученные на курсе, могут быть полезными на вашем текущем месте работы, оставляйте заявку с контактами компании в форме ниже или обсудите покупку курса с вашим руководителем. Как это организовать, что говорить и куда идти — написали здесь.
Как купить курс
старт в любой момент
Видеокурс
Видеоуроки
Практические задания
в рассрочку на 4 месяца или 18 900 ₽ единовременно