старт 21 сентября
7 дней
Интенсив по SRE
За 7 учебных дней соберёте SRE-пакет по знакомому сервису: SLI/SLO, error budget, сигналы мониторинга, план первых 15 минут инцидента, mini-postmortem и roadmap на 3 месяца. Без кода, Kubernetes и настройки окружения
Уже знакомы с SRE?
Попробуйте большой курс →
Кому подойдёт курс?
Присматриваетесь к SRE
Работаете или учитесь в IT и хотите понять, как SRE смотрит на надёжность сервисов и стоит ли двигаться в эту сторону
Работаете с инфраструктурой
Вы DevOps или системный инженер. Инфраструктуру уже знаете, но SLO, error budget, incident management и postmortem пока не сложились в единую систему
Отвечаете за сервис после релиза
Разработчик или инженер смежной роли: хотите понимать, что происходит после deploy и как говорить с SRE-командой на одном языке.
Начнёте говорить на языке SRE
Разберётесь, как связаны SLI, SLO, SLA, error budget, golden signals, toil и postmortem — и сможете объяснить, зачем всё это нужно сервису.
Посмотрите на сервис через надёжность
Сможете начать не с «какие метрики поставить», а с вопроса: что для пользователя значит «сервис работает»? От этого — перейти к показателям, целям и сигналам мониторинга.
Поймёте логику работы с инцидентом
Будете понимать, что важно определить в первые минуты сбоя, как распределить действия и почему работа с инцидентом не заканчивается на service restored
Поймёте свой следующий шаг
Увидите, какие SRE-навыки у вас уже есть, чего не хватает и что имеет смысл развивать дальше
Что останется у вас после интенсива?
SRE-пакет по выбранному сервису
Все задания интенсива собираются в один рабочий артефакт: SLO и error budget, сигналы мониторинга, план реакции на инцидент, mini-postmortem, работа с toil и ваш следующий roadmap
Что изменится за 7 дней
За неделю вы не станете SRE — зато разберётесь, как SRE смотрит на сервис, и попробуете этот подход на знакомом вам продукте
Автор и спикер курса
Руководитель команды SRE в RWB
Максим Гусев
Строит отказоустойчивые системы в IT более 11 лет
Активно проповедует искоренение тойла и построение правильного инцидент-менеджмента
Прошел путь от инженера по замене бумаги в принтере до техлида SRE в финтехе и Lead Observability Team в Dodo Engineering
Программа
Разбираем SRE как профессию и инженерный подход: чем отличается от DevOps и админа, почему надёжность — это продуктовая характеристика, и что значит «сервис работает» с точки зрения пользователя.

Результат:
Описание сервиса и пользовательское обещание
Как проходит обучение
Практика без кода и инструментов
Вся практика проходит без технического стенда. Вы выберете знакомый сервис и на его примере составите SLI и SLO, рассчитаете error budget, определите сигналы мониторинга, продумаете первые действия во время инцидента, подготовите mini-postmortem и карьерный план.
Формат:
Онлайн-интенсив в Telegram-чате
Расписание
7 учебных дней в течение двух недель
21.09 по 2.10, с перерывом на выходные
Старт потока
21 сентября 2026
Завершение потока
2 октября 2026
Каждый день включает
Материалы (статьи, скринкасты)
~35 мин
Авторское видео, подкаст или скринкаст по теме дня
10 – 15 мин
Задание на мышление
20 – 40 мин
Тест
5–7 вопросов
Обсуждение в чате
открытый вопрос для дискуссии
Специальных требований нет. Интенсив рассчитан на тех, кто работает или учится в ИТ. Достаточно общего понимания, что такое сервер, запрос и сервис.

Опыт в SRE, DevOps и работе с production не требуется. Все специальные термины и практики разберем с нуля на понятных примерах.
Минимальные требования
Не потребуется
Устанавливать инструменты
Писать код
Настраивать окружение
Работать с командной строкой
Знать Kubernetes, Prometheus или Grafana
Иметь доступ к production-системам
Для участия понадобятся
Telegram и браузер
Любое приложение для заметок
До четырех часов в день
старт 21 сентября
Стоимость участия
полезные материалы (доступ остается с вами навсегда)
скринкасты
ежедневные задания и групповая обратная связь от спикера в чате
итоговый SRE-пакет по выбранному сервису — первый артефакт для портфолио
5 000 ₽
После интенсива
Готовы перейти от разборов на знакомом сервисе к работе на стендах и командным инцидентам?
Большой SRE-курс — три недели работы SRE-командой: Kubernetes-стенды, мониторинг, SLO, аварии, восстановление сервиса и postmortem
5000 ₽
за интенсив зачтём в стоимость большого курса
Пока не готовы к обучению? Оставайтесь в теме
В телеграм-канале «Путь SRE» → собрали инциденты, SLO, observability, postmortem и задачи из production
Часто задаваемые вопросы
Нет. Курс рассчитан на тех, кто только знакомится с SRE. Достаточно общего понимания, что такое сервер, запрос и сервис.