Старший DevOps-инженер
Summary
Manages production Linux and cloud infrastructure, deploys and supports containerized services, and builds GitLab CI/CD and GitOps delivery pipelines. Uses Kubernetes, PostgreSQL, Redis, RabbitMQ, ELK, Nginx, Vault, Consul, Packer, Bash, and Python to automate operations, strengthen security, and ensure service resilience.
Зарплата: до 334248 RUR (до вычета налогов)
Формат работы: full-time (пн-пт), гибрид: 3 дня удаленно, 2 дня в офисе (м. Шоссе Энтузиастов).
Приятные моменты:
- Команда коллег с высоким уровнем компетенций и ориентацией на результат (5 человек в команде).
- Работа в штате надежного работодателя, все соц. гарантии, слаженная работа в дружеской обстановке.
- Собственные медицинские центры, скидка 50% на наши услуги для вас и прямых родственников, предоставление оплачиваемых дней по семейным событиям, спортивные тренировки и мероприятия.
Что мы ожидаем от вас:
- Диплом о высшем образовании, опыт работы на аналогичной позиции от 3-х лет.
- РЕД ОС (RedOS) или аналогичные системы — уверенное владение, развёртывание, настройка, администрирование, работа с подсистемой аудита и средствами защиты информации (соответствие требованиям ФСТЭК, 4 уровень доверия).
- Debian/Ubuntu, CentOS/Rocky (и аналогичные RPM-based дистрибутивы) — продвинутый уровень, администрирование production-среды;
- Docker, Docker Compose — уверенное владение, создание и оптимизация собственных образов (multi-stage сборки);
- Kubernetes, Helm — желательно: понимание компонентов кластера, деплоймент приложений, диагностика;
- Cilium (CNI/eBPF) — желательно: настройка сетевых политик, балансировка, наблюдаемость (Hubble);
- Longhorn — желательно: распределённое блочное хранилище, управления PV, снапшоты, репликация, бэкапы.
- GitLab CI — уверенное владение: проектирование, разработка и сопровождение пайплайнов;
- ArgoCD — желательно: GitOps-подход;
- Git — уверенное владение: ветвление, merge-request, code review.
- Nginx — уверенное владение: reverse-proxy, балансировка, TLS/SSL, проксирование веб-приложений.
- PostgreSQL — хорошее понимание: развёртывание, конфигурирование, резервное копирование и восстановление, репликация, мониторинг, базовая оптимизация запросов;
- Redis — уверенное владение: развёртывание, конфигурирование, очереди, мониторинг;
- RabbitMQ — уверенное владение: развёртывание, конфигурирование, очереди, мониторинг;
- ELK (Elasticsearch, Logstash, Kibana) — уверенное владение: сбор и анализ логов;
- Bash — уверенное владение;
- Python — опыт написания скриптов автоматизации;
- Jira, системы класса Service Desk — желательно: ведение задач, тикетов, взаимодействие в рамках ITSM-процессов.
- Vault, Consul, Packer.
Чем предстоит заниматься:
1. Написание и оптимизация Dockerfile, сборка собственных Docker-образов (в т.ч. multi-stage сборки, уменьшение размера и повышение безопасности образов).
2. Проектирование, разработка и сопровождение CI/CD-пайплайнов на базе GitLab CI:
- Автоматизация сборки, тестирования и доставки приложений в тестовые и production-окружения.
- Развёртывание, настройка и сопровождение сервисов с использованием Docker и Docker Compose (Redis, RabbitMQ, MinIO, PostgreSQL, Nginx и др.).
- Администрирование Linux-серверов на уровне production: развёртывание и обновление ОС, диагностика (в т.ч. на уровне процессов, памяти, сети), тюнинг производительности, обеспечение безопасности.
- Настройка и сопровождение Nginx в качестве веб-сервера и reverse-proxy, работа с DNS (настройка записей и зон, диагностика проблем разрешения имён).
- Администрирование PostgreSQL: развёртывание, конфигурирование, резервное копирование и восстановление, контроль производительности и репликации.
- Работа с облачными платформами МТС (MTS Cloud / МТС Web Services) и/или Yandex Cloud: развёртывание и сопровождение облачной инфраструктуры, управление ресурсами, сетями, хранилищами и доступом.
- Участие в регламентных работах, обновлениях и плановых технических окнах.
- Обеспечение бесперебойной работы и отказоустойчивости сервисов: контроль доступности, стабильности и производительности в production-среде.
- Проактивное выявление узких мест (bottlenecks), оптимизация производительности и capacity planning: прогнозирование нагрузки и планирование ресурсов.
- Снижение рутинного труда (toil reduction) и автоматизация операционных задач (bash, Python, IaC).
- Разработка и актуализация runbooks, инструкций и базы знаний для команд поддержки (L1/L2).
- Участие в ревью и поддержании актуальности планов аварийного восстановления (DRP).
- Взаимодействие с командами разработки: помощь в отладке, оптимизации процессов доставки, консультации по Dockerfile, GitLab CI и лучшим практикам надёжности.
- Управление секретами и доступами, поддержка тестовых и production-окружений.