Middle SRE инженер Trust & Safety
(удаленная работа)
(вакансия не опубликована)
18 сентября 2025
з.п. не указана
Не указан
Вакансия: Middle SRE инженер Trust & Safety
Описание вакансии
Wildberries и Russ лидер рынков e-commerce и наружной рекламы в России и странах СНГ.
Ежедневно более 4 тысяч наших IT-специалистов создают цифровую экосистему, состоящую из сотен тысяч продуктов. На сегодня мы создали крупнейшую онлайн-платформу для покупки и продажи товаров в России и странах СНГ.
Вместе с масштабным развитием IT-направления мы формируем культуру Trust and Safety, гарантируя непрерывную безопасность и доверие между компанией, её сотрудниками, пользователями и клиентами.
Мы команда репутационной системы это проект по созданию рейтингов доверия, которые помогает пользователям лучше ориентироваться среди продавцов и покупателей, а также выявлять нарушения и применять санкции. Мы хотим, чтобы система учитывала всё важное: от честности отзывов до качества жалоб и карточек товаров. Задача команды будет заключаться в том, чтобы продумать и воплотить все аспекты этой системы, обеспечивая прозрачность и мотивацию к улучшению для всех участников.
Наши задачи:
Обеспечение надежности и доступности сервисов с фокусом на SLA/SLO
Оптимизация производительности и устранение узких мест в инфраструктуре (ClickHouse, PostgreSQL, Redis, Kafka)
Внедрение и совершенствование SRE-практик: postmortem, incident management.
Настройка и управление алертами для мониторинга сервисов (Python, Go) и инфраструктуры
Развитие observability в тесном взаимодействии с командами разработки и MLOps
Автоматизация релизного процесса, CI/CD и инфраструктурных задач
Улучшение observability в тесном взаимодействии с командами разработки
Участие в архитектурных решениях для повышения отказоустойчивости и масштабируемости
Необходимые опыт и навыки:
Опыт работы в SRE/DevOps от 3 лет
Глубокое понимание принципов SRE и их применения
Экспертиза в настройке и эксплуатации ClickHouse, PostgreSQL, Redis, Kafka
Навыки работы с Kubernetes, Docker и распределенными системами
Опыт настройки и анализа метрик/логов (Prometheus, Grafana, OpenSearch)
Умение разрабатывать инструменты автоматизации (Python, Go)
Навыки управления инцидентами и проведения postmortem-анализа
Будет плюсом:
Опыт работы с высоконагруженными системами
Знание оптимизации запросов в ClickHouse/PostgreSQL
Глубокое понимание GitOps-принципов
Стремление глубоко вникать в предметную область и осваивать новые технологии .
Наш стек:
Observability: Prometheus, Grafana, OpenSearch, Sentry, OpenTelemetry.
Data Storage: ClickHouse, PostgreSQL, Redis, Kafka.
Automation: GitLab CI, Python/Go, GitOps.
Infrastructure: Kubernetes, Docker, Linux, сетевые протоколы.
Что мы предлагаем:
Полная удаленка или свободное посещение офисов в Москве и Санкт-Петербурге
IT-ипотека и оформление в аккредитованную IT-компанию
Бесплатное питание в офисах, ДМС со стоматологией (после испытательного срока)
Корпоративное обучение и IT-мероприятия
Наш процесс найма:
30-минутное HR интервью, чтобы рассказать о себе и узнать больше о вакансии
Техническое интервью длительностью 1 час
Финальное интервью с лидом длительностью 1.5 часа
