Сбер
Инженер SRE
О роли
Мы расширяем команду эксплуатации, которая поддерживает высоконагруженный рекомендательный движок. Наша система обрабатывает большие объемы данных в реальном времени и напрямую влияет на пользовательский опыт продукта. Сейчас команда состоит из 8 человек. Мы ищем специалиста, готового развиваться вместе с нами, погружаться в сложный технологический стек и обеспечивать стабильность сервисов.
Чем ты будешь заниматься
поддерживать работоспособность инфраструктуры решения по выдаче рекомендаций под руководством старших инженеров
участвовать в раскатке сервисов на тестовые и продуктивные стенды через настроенные CI/CD пайплайны (GitLab, Jenkins, ArgoCD)
проводить мониторинг состояния систем (Prometheus, Loki, Grafana), первичный анализ алертов и логов при поступлении инцидентов от первой линии поддержки
решать баги инфраструктуры во время дежурств (on-call) и в штатном режиме
вносить изменения в инфраструктуру с помощью IaC-инструментов (Terraform, Helm-чарты) по готовым шаблонам и инструкциям
помогать в оптимизации конвейеров обработки данных (Airflow, Spark) и работе распределенных хранилищ (MongoDB, PostgreSQL, Redis)
писать простые скрипты автоматизации на Python для рутинных задач обслуживания системы
Мы ожидаем, что ты имеешь
наличие высшего образования
опыт администрирования Linux-систем от 1 года, уверенная работа с командной строкой, понимание процессов, файловой структуры и сетевого стека TCP/IP
базовый практический опыт работы с Docker и оркестратором Kubernetes (понимание принципов Pod, Service, Ingress, ConfigMap)
знакомство с системами контроля версий (Git) и CI/CD инструментами
понимание принципов работы реляционных (PostgreSQL) и нереляционных (MongoDB, Redis) баз данных на уровне написания простых запросов и проверки доступности
навык чтения кода на Python для разбора существующих скриптов автоматизации
опыт применения LLM в работе: использование нейросетей как инструмента для ускорения рабочих задач (генерация bash/python скриптов, помощь в разборе сложных ошибок в логах, написание документации)
готовность к участию в дежурствах второй линии поддержки (3–4 раза в месяц) и обучению культуре Incident Response
**будет преимуществом:**
минимальный опыт настройки мониторинга метрик в Prometheus и визуализации в Grafana
опыт запуска сборок в GitLab или Jenkins
Работа в Сбере — это
гибридный формат в Москве (Кутузовский пр, 32)
ежегодный пересмотр зарплаты и годовая премия
расширенный ДМС и льготное страхование для семьи
уникальная система обучения Сбера для профессионального и карьерного развития
выгодная ипотека для сотрудников
подписка Прайм с возможностью совместного использования на трёх близких
вознаграждение за рекомендацию друзей в команду Сбера
корпоративная пенсионная программа.
