Сбер
SRE Senior ( ИИ-помощник)
О роли
Наша команда создает линейку продуктов на основе мультимодальной нейросетевой модели GigaChat, которая является одной из самых мощных и продвинутых моделей искусственного интеллекта, доступных на сегодняшний день. Мы создаем удобный и понятный сервис, позволяющий людям использовать GigaChat для решения повседневных задач и развлечения: поиск ответов на вопросы, работа с документами, создание контента, изучение языков, общение с персонажами и многое другое. Мы ищем опытного Senior-инженера SRE, который возглавит развитие front-инфраструктуры. Вы будете отвечать не только за техническую реализацию, но и за менторство команды, архитектурные решения и стратегическое развитие надежности сервиса. Ваша ключевая задача — построение и развитие системы Observability для высоконагруженной micro-frontend архитектуры, обеспечение ее отказоустойчивости, масштабируемости и безопасности. Вы будете напрямую влиять на SLA/SLI/SLO сервиса и качество продукта, которым пользуются миллионы.
Чем ты будешь заниматься
проектирование, внедрение и поддержка отказоустойчивой front-инфраструктуры **giga.chat**.
построение сквозной системы мониторинга, логирования и трейсинга (Observability) для micro-frontend систем.
организация процесса управления инцидентами (Incident Management), поиски (Root Cause), внедрение превентивных мер.
развитие инфраструктуры как кода (Infrastructure as Code), автоматизация процессов развертывания, масштабирования и управления конфигурациями.
наставничество Middle-инженеров, code-review инфраструктурного кода, развитие инженерных практик в команде.
Мы ожидаем, что ты имеешь
Будет плюсом:
**Уровень:** Senior (от 5 лет опыта в SRE/DevOps), наличие подтвержденного опыта на позиции Team Lead или готовность к руководящей роли.
**Архитектура и сети:**
Глубокое понимание принципов построения высоконагруженных и отказоустойчивых систем.
Экспертное знание сетевого стека (модель OSI, TCP/IP, BGP, DNS). Опыт диагностики сложных сетевых проблем в production-среде.
Экспертный уровень владения балансировщиками: NGiNX (включая Lua/NJS для сложной логики), HAProxy, Traefik. Опыт их тюнинга под экстремальные нагрузки.
**Observability:**
Успешный опыт построения комплексных систем Observability "с нуля" для микросервисных и micro-frontend архитектур.
Экспертиза в стеке Prometheus + Grafana: написание сложных PromQL-запросов, проектирование дашбордов и алертов.
Глубокое знание систем логирования (ELK Stack) и распределенной трассировки (Jaeger, Zipkin). Умение коррелировать метрики, логи и трейсы для быстрого поиска аномалий.
**Безопасность:**
Глубокие знания в области информационной безопасности. Опыт внедрения Zero Trust архитектуры, настройки WAF, защиты от DDoS-атак на уровне L7, управления секретами (Vault).
**Инфраструктура:**
Экспертный уровень администрирования Linux.
Экспертиза в Kubernetes: управление кластерами в production, написание Helm-чартов, диагностика проблем на уровне Control Plane и Data Plane.
Уверенное владение IaC-инструментами (Terraform, Ansible) на уровне написания модулей и ролей.
Опыт работы с облачными провайдерами (Sber Cloud, Yandex Cloud, AWS) на уровне построения гибридных инфраструктур.
Опыт работы с Service Mesh (Istio)
Опыт работы с базами данных (PostgreSQL, Elasticsearch, ClickHouse, Mongo)
Опыт работы с системами очередей и кеш-серверами (Kafka, Ignite, Redis)
Работа в Сбере — это
стабильный оклад и премии по результатам работы, ежегодный пересмотр зарплаты
комфортный современный офис рядом с м.Кутузовская
гибридный формат работы: встречаемся очно в офисе 1 раз в неделю
корпоративный спортзал и зоны отдыха
уникальная система обучения Сбера для профессионального и карьерного развития
программа адаптации и помощь руководителя на старте
расширенный ДМС и льготное страхование семьи
гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
бесплатная подписка СберПрайм, скидки на продукты компаний-партнеров
вознаграждение за рекомендацию друзей в команду Сбера
корпоративная пенсионная программа
