практикум

Highload: Monitoring & Observability

Освойте стек Prometheus, EFK, OpenTelemetry и Zabbix на практике. Научитесь связывать метрики, логи и трассы для мгновенного поиска причин сбоев в Highload-системах.

темы, которые вы освоите

Prometheus
Grafana
OpenTelemetry
Elasticsearch
Fluent Bit
Kibana
Jaeger
Zabbix
Kubernetes
Graylog
Alertmanager
Node Exporter
cAdvisor
TimescaleDB
Сокращение MTTR
Интеграция логов, метрик и трасс позволяет находить первопричину сбоя в микросервисах за минуты вместо часов.
Экономия ресурсов
Оптимизация хранения (Prometheus relabeling, Elasticsearch ILM) позволяет кратно сократить объём хранимых данных без потери диагностической ценности.
Стандартизация
Переход на OpenTelemetry защищает компанию от вендор-лока и упрощает масштабирование телеметрии.
Стабильность систем
Умный алертинг с подавлением зависимых аварий предотвращает выгорание дежурной смены и гарантирует реакцию на критические инциденты.
Rebrain
— большое сообщество IT-специалистов, создаём
практикумы по инфраструктуре с 2018 года
Почему выбирают наши программы
  • Автоматические проверки — мгновенная обратная связь по заданиям
  • Проверки менторами — DevOps-инжерами с опытом в индустрии от 5+ лет
  • Возможность общаться с опытными практикующими специалистами
  • Свободный темп — проходите без жёстких дедлайнов
  • Прикладные задачи — кейсы, приближенные к реальной работе DevOps-инженера
phone

Кому подойдёт

DevOps-инженеры

Специалисты, желающие внедрить современные стандарты наблюдаемости, сократить время локализации аварий (MTTR) и автоматизировать сбор телеметрии.

SRE-специалисты

Инженеры, которым необходимо оптимизировать хранение гигабайтов метрик, настроить умный алертинг без спама и трассировать распределённые запросы.

Системные администраторы

Специалисты, стремящиеся вырасти в DevOps/SRE через освоение передовых инструментов мониторинга, логирования и распределенной трассировки.

Как проходит
практикум

Команда Rebrain изучает, какие из компетенций требуются на разных уровнях профессий.

программа практикума

Программа

  • Введение
  • Prometheus: установка
  • Prometheus: Node exporter
  • Prometheus: Alertmanager
  • Grafana dashboards
  • Мониторинг Docker
  • Мониторинг Kubernetes
  • OpenTelemetry: трассировка и метрики
  • Elasticsearch и Kibana: единичный экземпляр
  • EFK: настройка агента Fluent Bit
  • KQL и анализ логов в Kibana
  • Распределённый кластер Elasticsearch
  • Graylog vs EFK
  • Zabbix: установка и активный агент
  • Zabbix: LLD, Proxy и оптимизация хранения
  • Алертинг: интеграция с Telegram и Slack
  • Итоговый проект (Финальное задание)
  • Заключение

Тренажёры

  • Relabeling: снижение кардинальности Node Exporter
  • Дерево маршрутов и цепочка подавления в Alertmanager
  • Маршрутизация и санитизация телеметрии в OTel Collector
  • Парсинг разнородных логов и маршрутизация индексов во Fluent Bit
  • Кастомный LLD в Zabbix: разделы, фильтры и прототипы
Эксперт практикума
Юрий Береговой
Юрий Береговой

Разрабатываю backend на Java/Spring и параллельно держу инфраструктуру: Kubernetes, Terraform и Ansible для IaC, CI/CD на Jenkins, облака AWS/GCP. Последние несколько лет всё глубже ухожу в DevOps - начинал с собственных pet-проектов в облаке, сейчас занимаюсь оркестрацией и пайплайнами всерьёз. Больше всего ценю нестандартные задачи, на которых реально прокачиваешься.

Senior Software Engineer eQ3

Ключевые навыки для резюме:

Проектирование и развертывание распределенных отказоустойчивых кластеров хранения логов
Конфигурирование сквозной распределенной трассировки запросов с использованием стандартов OpenTelemetry
Тонкая настройка фильтрации метрик (Relabeling) и политик управления индексами логов (ILM) для экономии ресурсов
Построение сложных деревьев маршрутизации и механизмов подавления алертов для борьбы с alert fatigue
Автоматизация обнаружения динамической инфраструктуры с помощью кастомных LLD-скриптов в Zabbix
Развёртывание мониторинга Kubernetes-кластера через Prometheus Operator с описанием сбора в ServiceMonitor

Пример задания

Вам предстоит спроектировать и развернуть комплексный отказоустойчивый стенд Observability для микросервисного приложения. Вы будете интегрировать сбор метрик (Prometheus), логов (Fluent Bit в распределенный Elasticsearch) и трасс (OpenTelemetry в Jaeger) в единую систему, настроите аналитический дашборд в Grafana и организуете умный алертинг в Telegram при деградации производительности API.

Остались вопросы?
Приходите на бесплатную консультацию с экспертом.

Нажимая кнопку, я соглашаюсь с условиями Пользовательского соглашения

практикум

Highload: Monitoring & Observability

В стоимость входит:

  • Выполнение задач на настоящей инфраструктуре
  • Сопровождение — менторы, координатор
  • Бессрочный доступ к теоретической части практикума
стоимость
Практикум
8 750 руб.
7 500 руб.

раз в 2 недели или сразу 30 000 руб.

Перейти к оплате >>>
Практикум+тренажёры
3 334 руб.
2 917 руб.

в месяц или сразу 35 000 руб.

Перейти к оплате >>>
FAQ

Zabbix незаменим для классической инфраструктуры, сетей и аппаратных серверов. В курсе мы учим масштабировать обе системы и использовать их сильные стороны.

Курс ориентирован на специалистов уровня Middle. Требуются базовые знания Linux, Docker и сетей, так как мы сразу переходим к сложным конфигурациям и оптимизации.

Да. OpenTelemetry — graduated-проект CNCF и де-факто отраслевой стандарт телеметрии. В курсе разбираются архитектура Collector, сбор трасс и метрик и их экспорт в Jaeger и Prometheus

Файлы куки

При использовании данного сайта, вы подтверждаете свое согласие на использование файлов cookie и других похожих технологий в соответствии с настоящим Уведомлением.