SRE-инженер

Уровень зарплаты: от 350 000 руб.
Местоположение: Россия, Санкт-Петербург и область (МСК +0ч)

Резюме: SRE-инженер

Senior SRE / DevOps инженер с 6.5 годами опыта в IT (из них 3+ года в построении высоконагруженных систем). Вырос из инженера техподдержки до Senior SRE в топ-3 банке РФ. Специализируюсь на автоматизации инфраструктуры, observability и обеспечении отказоустойчивости. Основной стек: Linux, Kubernetes, Ansible, Bash, GitLab CI, Oracle, Clickhouse, PostgreSQL, AWS, Kafka

Опыт работы:

Банк ДОМ.РФ (3 года) SRE инженер

Разработал и внедрил Disaster Recovery Plan (DRP), проведя полный аудит инфраструктуры, что обеспечило целевое время восстановления (RTO) для критичных сервисов в пределах 15 минут.

Сократил время реакции на типовые инциденты на 90%, разработав runbook'и и автоматизировав сценарии восстановления с помощью Ansible и Python-скриптов.

Ускорил вывод новых фич в production в 2 раза, спроектировав и внедрив унифицированные CI/CD-шаблоны (GitLab CI) для продуктовой команды.

Повысил observability системы для 40+ серверов, используя кластер мониторинга (Prometheus, Grafana, Zabbix) и настроив алертинг.

Сократил ручную работу команды администрирования на 40% (~20 часов/неделю), автоматизировав провижининг инфраструктуры (Astra Linux) через Ansible.

Менторил Middle-инженера, что позволило ему самостоятельно закрывать до 70% задач по инфраструктуре и разгрузить команду.

Russ Outdoor (1 год) Devops инженер
Внедрил систему auto-remediation на базе StackStorm + Zabbix, что позволило автоматически закрывать до 30% типовых инцидентов (рестарты сервисов, очистка дисков) без участия дежурных инженеров.

Обеспечил 100% консистентность данных об инфраструктуре (1000+ ВМ), написав Python-скрипты для двусторонней синхронизации между NetBox (Source of Truth) и VMware vSphere.

Обеспечил отказоустойчивость кластера Kafka настроив мониторинг и репликацию для бесперебойной работы рекламных систем.

Оптимизировал CI/CD процессы (GitLab CI, Jenkins), сократив время сборки внутренних приложений на 20% за счет кэширования и параллельного выполнения джобов.


Ростелеком-Солар (1 год 3 месяца) Инженер сервиса
Автоматизировал развертывание систем безопасности (DLP, NGFW) для Enterprise-клиентов с помощью Ansible и Docker, сократив время внедрения с нескольких дней до 4 часов.

Разработал библиотеку Bash/Python скриптов для автоматической конфигурации сетевого оборудования и прокси-серверов.

Внедрил кастомный мониторинг клиентских инсталляций (Zabbix, Prometheus), что позволило проактивно выявлять аномалии до обращения заказчиков в саппорт.

Посмотрите похожие резюме

DevOps
Зарплата: 300 000 руб.
DevOps / SRE
Зарплата: 100 000 руб.
Tech Lead / Platform Engineer (Python)
Зарплата: 350 000 руб.