Kaizen Official Group

Настраиваю Linux-серверы, мониторинг, Docker и CI/CD

Меня зовут Дмитрий Савичев. Делаю так, чтобы о сбое вы узнавали от системы, а не от клиентов, и чтобы выкатка не зависела от того, помнит ли кто-то порядок команд.

Работаю удалённо, один. Отвечаю обычно в тот же день.

Дмитрий Савичев

Дмитрий Савичев

SRE/DevOps-инженер

Экран панели мониторинга в Telegram: активные инциденты, доступность адресов и нагрузка серверов
Панель мониторинга, которую я сделал себе. Разбор

Знакомо?

С чем ко мне приходят чаще всего

О сбое узнают клиенты

Сайт лежит сорок минут, пока кто-то не напишет в поддержку.

Ставлю проверки и уведомления — сообщает система.

Алертов так много, что их не читают

Двадцать сообщений в час, и среди них теряется важное.

Развожу сигналы: один сбой — одно сообщение.

Никто не знает, как всё устроено

Настраивал подрядчик два года назад. Трогать страшно.

Пишу разбор того, что есть, и план — что чинить первым.

Услуги

Восемь направлений

  • Мониторинг, логи и алерты
  • Аудит сервера и доступов
  • Диагностика инцидентов
  • Docker и окружение
  • Развёртывание и CI/CD
  • Бэкапы и восстановление
  • Kafka и очереди
  • Боты и автоматизация

Что именно делаю в каждом — на странице услуг

Работа

Что я сделал и чем это проверено

Всё — на своей инфраструктуре, которую я веду как боевую. Чужих проектов здесь нет, и я не выдаю свои за чужие.

Все разборы

После работы у заказчика остаётся отчёт: что нашёл, что сделал, чем проверил и что осталось. Вот его пример.

Напишите в двух словах, что у вас за инфраструктура и что беспокоит. Этого хватит, чтобы понять, могу ли я помочь.