Организовать работу группы по поддержке веб технологий и Linux систем
Организовать развертывание систем и сред, обеспечить помощь в переносе готовых приложений из тестовых сред на продуктивные;
Организовать поддержку серверов на базе Linux;
Организовать поддержку СУБД, хранилищ, очередей;
Организовать поддержку инфраструктуры виртуализации;
Организовать поддержку серверов и систем хранения данных;
Организовать построение CI/CD;
Организовать поддержку WEB серверов, защиту от различных видов атак;
Вести задачи полного цикла по разработке новых механизмов инструментов DevOps;
Вести сбор требований с заказчиков, выполнять прототипирование, реализацию и тестирование, документирование, тиражирование и поддержку (разбор и устранение инцидентов, исправление дефектов);
Управлять командой, планировать спринты, распределять задачи, проводить встречи один на один, менторство.
Участвовать в найме, онбординге и развитии инженеров DevOps.
Автоматизировать и улучшать процессы развертывания приложений;
Внедрять новые технологии и процессы DevOps;
Выполнять и контролировать выполнение задача, поступающие через систему управления ИТ и сервисным обслуживанием;
Вести инфраструктурные и платформенные проекты под ключ (инициация, планирование, исполнение, контроль, завершение).
Формировать и согласовывать цели, объем работ, сроки, ресурсы, критерии приемки и ожидаемый эффект для бизнеса.
Вести план-график, бэклог/реестр задач, управлять приоритетами, зависимостями и рисками.
Организовывать процесс управления изменениями, согласование окон работ, коммуникации, планы отката;
Обеспечивать регулярные статусы и отчетность для заказчиков, управлять ожиданиями, своевременно эскалировать проблемы;
Координировать взаимодействие между разработкой, эксплуатацией, ИБ, сетевой командой и внешними подрядчиками.
Организовать, поддерживать и развивать систему мониторинга корпоративных информационных систем, подготовить SLA;
Заниматься масштабированием, анализом инцидентов и выявлением узких мест;
Диагностировать и устранять проблемы в функционировании сервисов;
Обеспечить безопасность ИТ инфраструктуры от любых видов внешних атак и несанкционированного доступа;
Поддержка жизненного цикла инфраструктурного ПО;
Проектировать, внедрять, развивать и поддерживать процедуры резервного копирования;
Проектировать, внедрять, развивать и поддерживать системы нагрузочного тестирования веб-приложений компании (совместно с разработчиками);
Составлять техническую, технологическую и регламентную документацию, поддерживать в актуальном состоянии базы знаний ИТ-инфраструктуры компании по вверенным зонам ответственности;
Требования:
Руководство командой DevOps в формате 60% менеджмент / 40% ручная работа;
Постановка задач и контроль исполнения, приоритизация, планирование итераций, управление загрузкой;
подбор персонала и адаптация, развитие компетенций сотрудников, регулярные встречи, оценка эффективности, выстраивание взаимодействия между специалистами DevOps, разработкой и бизнесом;
Опыт управления командой (3+ лет)
Коммуникация с бизнес заказчиками, разработкой, менторство, обратная связь.
Linux опытный администратор,
Gitlab архитектура и компоненты, проектирование и поддержка CI/CD, написание пайплайнов.
Docker сборка образов, дистрибуция контейнеров через registry, запуск образов.
Опыт настройки мониторинга: Zabbix, Prometheus + Grafana.
Опыт настройки сбора логов: ELK, VictoriaLogs.
Навыки развертывания и поддержки кластеров Haproxy, MySQL, MongoDB, Redis.
Формирование и ведение плана развития инфраструктуры, управление приоритетами, зависимостями и рисками для обеспечения сроков и предсказуемого результата проектных задач.
Подготовка и проведение изменений, планирование окон для проведения регламентных работ, практики обновления и отката.
Регулярное информирование заинтересованных сторон о ходе работ и сроках, согласование ожиданий и приоритетов, своевременное вынесение проблемных вопросов на уровень руководства для принятия решений.
Обеспечение надежности и доступности ключевых сайтов компании.
Эксплуатация on prem инфраструктуры под бизнес критичные сервисы.
Формирование документации и регламентов.
Инцидент менеджмент и эксплуатационные практики, расследование инцидентов, postmortem без поиска виноватых, внедрение превентивных мер.
Настройка и сопровождение балансировки нагрузки на уровнях L4/L7, диагностика и устранение сетевых инцидентов, координация работ с сетевыми специалистами; Виртуализация VMware vSphere/ESXi.
Terraform/IaC для описания инфраструктуры и воспроизводимости.
Сильные навыки управления проектами;
Условия:
Формат работы- Зорге, 1, стр.1 (гибридный график) или удаленная работа