Мы расширяем команду эксплуатации, которая поддерживает высоконагруженный рекомендательный движок. Наша система обрабатывает большие объемы данных в реальном времени и напрямую влияет на пользовательский опыт продукта. Сейчас команда состоит из 8 человек. Мы ищем специалиста, готового развиваться вместе с нами, погружаться в сложный технологический стек и обеспечивать стабильность сервисов.
Обязанности
- поддерживать работоспособность инфраструктуры решения по выдаче рекомендаций под руководством старших инженеров
- участвовать в раскатке сервисов на тестовые и продуктивные стенды через настроенные CI/CD пайплайны (GitLab, Jenkins, ArgoCD)
- проводить мониторинг состояния систем (Prometheus, Loki, Grafana), первичный анализ алертов и логов при поступлении инцидентов от первой линии поддержки
- решать баги инфраструктуры во время дежурств (on-call) и в штатном режиме
- вносить изменения в инфраструктуру с помощью IaC-инструментов (Terraform, Helm-чарты) по готовым шаблонам и инструкциям
- помогать в оптимизации конвейеров обработки данных (Airflow, Spark) и работе распределенных хранилищ (MongoDB, PostgreSQL, Redis)
- писать простые скрипты автоматизации на Python для рутинных задач обслуживания системы
Требования
- наличие высшего образования
- опыт администрирования Linux-систем от 1 года, уверенная работа с командной строкой, понимание процессов, файловой структуры и сетевого стека TCP/IP
- базовый практический опыт работы с Docker и оркестратором Kubernetes (понимание принципов Pod, Service, Ingress, ConfigMap)
- знакомство с системами контроля версий (Git) и CI/CD инструментами
- понимание принципов работы реляционных (PostgreSQL) и нереляционных (MongoDB, Redis) баз данных на уровне написания простых запросов и проверки доступности
- навык чтения кода на Python для разбора существующих скриптов автоматизации
- опыт применения LLM в работе: использование нейросетей как инструмента для ускорения рабочих задач (генерация bash/python скриптов, помощь в разборе сложных ошибок в логах, написание документации)
- готовность к участию в дежурствах второй линии поддержки (3–4 раза в месяц) и обучению культуре Incident Response
будет преимуществом:
- минимальный опыт настройки мониторинга метрик в Prometheus и визуализации в Grafana
- опыт запуска сборок в GitLab или Jenkins
Условия
- гибридный формат в Москве (Кутузовский пр, 32)
- ежегодный пересмотр зарплаты и годовая премия
- расширенный ДМС и льготное страхование для семьи
- уникальная система обучения Сбера для профессионального и карьерного развития
- выгодная ипотека для сотрудников
- подписка Прайм с возможностью совместного использования на трёх близких
- вознаграждение за рекомендацию друзей в команду Сбера
- корпоративная пенсионная программа.
Похожие вакансии
Опыт работы инженером-механиком или сервисным инженером от 1 года. Знание принципов работы пищевого или аналогичного промышленного оборудования.
опыт работы по профилю от 3 лет. — опыт работы с измерительным и испытательным оборудованием. — группа допуска по электробезопасности ( обязательная аттестация...
Опыт обслуживания и ремонта современных систем кондиционирования и вентиляции. Практические навыки работы с контроллерами систем вентиляции. Умение работать с холодильным...
Умение самостоятельно принимать инженерные решения и уметь их обосновать. Приветствуется опыт ведения авторского надзора, опыт проведения визуального обследования существующих зданий...
Высшее техническое образование (приборостроение, Радиотехника, Конструирование и технология электронных средств). Знание элементной базы комплектующих. Владение программными пакетами (например,Altium Designer...
