Мы ищем DevOps-инженера, который поможет развивать надёжную и масштабируемую инфраструктуру наших продуктов. Работаем с высоконагруженными сервисами, большими объёмами данных и активно растущей экосистемой — поэтому нам нужен специалист, способный автоматизировать процессы, повышать стабильность систем и быстро находить причины инцидентов.
Чем предстоит заниматься
- Развивать и поддерживать инфраструктуру в Яндекс Облаке, Vk Cloud и DigitalOcean.
- Администрировать и масштабировать Kubernetes-кластеры.
- Разрабатывать и поддерживать Helm-чарты.
- Автоматизировать развёртывание приложений и инфраструктуры.
- Поддерживать и улучшать CI/CD-процессы.
- Обеспечивать отказоустойчивость, безопасность и наблюдаемость сервисов.
- Настраивать мониторинг, логирование и систему оповещений.
- Работать с PostgreSQL, Redis, NATS и ClickHouse.
- Оптимизировать производительность инфраструктуры и расходы на облачные ресурсы.
- Участвовать в расследовании инцидентов и устранять их первопричины.
- Взаимодействовать с командами разработки и помогать им эффективно доставлять изменения в production.
Что для нас важно
Обязательный практический опыт:
- Kubernetes — развёртывание, эксплуатация, обновление и диагностика кластеров.
- Яндекс Облако — работа с вычислительными ресурсами, сетями, хранилищами и управляемыми сервисами.
- DigitalOcean — развёртывание и сопровождение облачной инфраструктуры.
- PostgreSQL — администрирование, резервное копирование, репликация и базовая оптимизация.
- Helm и разработка Helm-чартов.
- Redis.
- NATS.
- ClickHouse.
Также ожидаем:
- Уверенное владение Linux.
- Понимание сетевых технологий, DNS, балансировки нагрузки и TLS.
- Опыт построения CI/CD-пайплайнов.
- Навыки Infrastructure as Code; опыт с Terraform будет преимуществом.
- Опыт работы с системами мониторинга и логирования.
- Понимание принципов отказоустойчивой и безопасной инфраструктуры.
- Способность самостоятельно принимать технические решения и доводить задачи до результата.
Будет плюсом
- Опыт эксплуатации высоконагруженных систем.
- Настройка Prometheus, Grafana и централизованного сбора логов.
- Опыт построения disaster recovery-процессов.
- Практика оптимизации облачных расходов.
- Опыт работы с микросервисной архитектурой.
- Навыки автоматизации на Bash, Python или Go.
Что мы предлагаем
- Работу над востребованными продуктами с реальной нагрузкой и интересными инфраструктурными задачами.
- Возможность влиять на архитектуру, инструменты и технические процессы.
- Минимум бюрократии и прямое взаимодействие с командой разработки.
- Пространство для самостоятельных решений и профессионального роста.
- Удалённый формат работы.
- Конкурентную заработную плату по результатам собеседования.
- Оформление и условия сотрудничества обсуждаются индивидуально.
Как будет оцениваться результат
- Стабильность и предсказуемость production-среды.
- Скорость и безопасность доставки изменений.
- Снижение количества повторяющихся инцидентов.
- Качество автоматизации и документации.
- Эффективное использование инфраструктурных ресурсов.
Если вам интересно не просто поддерживать инфраструктуру, а системно улучшать её, влиять на надёжность продуктов и развивать DevOps-практики вместе с командой Hezzl — будем рады познакомиться.
