Специалист мониторинга и дежурной службы эксплуатации (удаленная работа)

22 августа 2026

Уровень зарплаты:
з.п. не указана
Требуемый опыт работы:
Не указан

Вакансия: Специалист мониторинга и дежурной службы эксплуатации

Описание вакансии

Крупная российская компания с развитым бизнесом и собственными IT-решениями. Мы создаём и развиваем цифровые продукты, автоматизируем бизнес-процессы и внедряем современные технологии.

Работаем над масштабными задачами, где IT напрямую влияет на развитие бизнеса.

Ищем специалиста для работы в круглосуточной дежурной службе: вы будете первой линией защиты стабильности сервисов оперативно фиксировать алерты, проводить первичную диагностику, запускать процессы реагирования и помогать держать доступность систем на целевом уровне. Роль предполагает чёткое следование регламентам, работу в стрессовых ситуациях и постоянное взаимодействие со смежными командами. Вы станете частью команды, которая не просто гасит пожары , а снижает количество инцидентов за счёт аккуратной настройки мониторинга, актуализации инструкций и улучшения наблюдаемости.

Задачи

  • Оперативно реагировать на алерты в рамках SLA: регистрировать инциденты, выполнять первичную диагностику (логи, метрики, базовые проверки), запускать эскалацию по матрице, координировать вовлечённые команды, контролировать закрытие.
  • Выполнять типовые эксплуатационные операции по регламенту: перезапуски сервисов, проверку доступности, очистку временных файлов, контроль дискового пространства, проверку статусов реплик и очередей.
  • Настраивать и поддерживать базовые элементы мониторинга: добавлять простые алерты и пороги, проверять корректность сбора метрик, помогать снижать шум (ложные срабатывания), актуализировать runbooks и инструкции для дежурных.
  • Собирать и фиксировать данные по инцидентам: описывать симптомы, шаги диагностики, причину, принятые меры, эффект; формировать краткие отчёты для разбора и базы знаний.
  • Взаимодействовать со смежными командами (разработка, DevOps, SRE, поддержка): передавать детали проблемы, уточнять сроки исправления, согласовывать откаты или временные решения.
  • Участвовать в учениях и разборах инцидентов (post mortem): помогать фиксировать выводы, предлагать простые улучшения процессов и проверок.
  • Вести и актуализировать документацию: регламенты дежурств, чек листы, матрицы эскалации, инструкции по типовым сценариям.
  • Следить за окнами релизов и плановых работ: проверять контрольные точки мониторинга, фиксировать отклонения, при необходимости запускать эскалацию.

Требования

  • Опыт работы в эксплуатации, дежурной службе или поддержке от 1 2 лет, понимание процессов 24 7 и базовых принципов SLA.
  • Уверенное владение инструментами мониторинга и алертинга (Prometheus, Grafana, Zabbix, Nagios, ELK/Loki или аналоги) и умение читать дашборды и алерты.
  • Практические навыки работы в Linux: навигация по файловой системе, просмотр логов, проверка сетевых соединений, анализ загрузки CPU/памяти/диска, диагностика простых проблем.
  • Понимание сетевых основ (TCP/IP, DNS, HTTP, базовые фаерволы) и того, как сетевые проблемы отражаются в метриках и логах.
  • Умение чётко и кратко описывать проблему и действия: писать понятные инциденты и комментарии для других инженеров.
  • Хорошие коммуникативные навыки: способность спокойно и структурированно общаться в стрессовой ситуации, задавать правильные вопросы смежным командам.
  • Готовность к дежурствам и оперативному включению в инциденты, в том числе в нерабочее время.

Что предлагаем

  • Конкурентную заработную плату уровень дохода обсуждаем индивидуально с учётом опыта и экспертизы
  • ДМС заботимся о здоровье сотрудников и предоставляем расширенные программы
  • Обучение и развитие доступ к курсам, профессиональным программам и внутреннему обучению
  • Карьерный рост возможности развиваться в своей специализации и переходить на новые направления
  • Интересные IT-задачи участие в проектах, которые напрямую влияют на развитие крупного бизнеса
  • Современный стек и технологии возможность работать с актуальными инструментами и подходами
  • Гибкий формат работы обсуждаем удобный формат взаимодействия в зависимости от позиции и задач
  • Сильная команда работа с опытными специалистами из IT и смежных бизнес-направлений
  • Стабильность крупная компания с масштабными проектами и долгосрочными планами развития
  • Корпоративные бонусы скидки на продукцию компании и дополнительные программы для сотрудников
  • Комфортные условия работы современная рабочая среда, необходимые инструменты и всё для эффективной работы


Посмотрите похожие вакансии