Описание вакансии
Задачи:
— Развёртывание и эксплуатация продуктовых систем компании во всех средах: prod, stage, test, qa, demo.
— Настройка, развитие и сопровождение CI/CD-пайплайнов для backend-сервисов (.NET), web-frontend, Node.js-сервисов и мобильных приложений (iOS/Android), включая подпись и публикацию в магазины приложений.
— Сопровождение self-hosted GitLab, GitLab Runner и Container Registry: обновления, бэкапы, восстановление, производительность, права доступа.
— Эксплуатация контейнерной платформы на Docker Swarm: деплой сервисов, конфигурации и секреты, сетевой слой, обратный прокси (Traefik/nginx), TLS-сертификаты.
— Обеспечение воспроизводимости и единообразия окружений, контроль отличий между средами.
— Автоматизация инфраструктуры как кода (Ansible, Terraform или аналоги), отказ от ручных правок на серверах.
— Построение и сопровождение мониторинга, логирования и алертинга (Grafana, Prometheus, Loki, Alertmanager): SLO/SLI для продуктовых систем, дашборды, дежурные уведомления.
— Организация резервного копирования и регулярной проверки восстановления для PostgreSQL, MinIO, GitLab и конфигураций.
— Эксплуатация инфраструктурных компонентов платформы: PostgreSQL, Kafka, RabbitMQ, MinIO, Keycloak, Redis, включая обновления и миграции.
— Работа с облачной инфраструктурой (Yandex Cloud: Cloud Functions, API Gateway, Object Storage, DNS) и GitHub Actions для облачных сервисов.
— Внедрение практик безопасности в поставку: SAST/SCA, secret scanning, сканирование образов, управление секретами, ротация ключей, минимизация привилегий.
— Подготовка и сопровождение runbook по каждой системе: перезапуск, откат, диагностика, восстановление после сбоя; участие в разборе инцидентов и постмортемах.
— Участие в проектировании архитектуры новых цифровых сервисов с точки зрения деплоя, отказоустойчивости, наблюдаемости и стоимости эксплуатации.
— Совместная с разработчиками настройка quality gates в CI/CD и стандартов ветвления, релизов и версионирования.
Требования:
— Высшее образование в области информационных технологий, прикладной математики, программной инженерии, автоматизации, вычислительной техники или смежных технических направлений.
— Опыт работы не менее 5 лет в ИТ-инфраструктуре или разработке, из них не менее 3 лет в роли DevOps/SRE-инженера с ответственностью за production.
— Дополнительное профильное обучение по разработке ПО, архитектуре, DevOps, cloud, тестированию или ИБ будет преимуществом.
— Опыт построения DevOps-практик с нуля в небольшой команде: стандарты, пайплайны, мониторинг, runbook, а не только поддержка готового.
— Опыт работы с распределённой по нескольким площадкам инфраструктурой (несколько хостинг-провайдеров плюс публичное облако).
— Опыт организации дежурства и реагирования на инциденты, проведения постмортемов.
— Опыт проверенного восстановления из бэкапов, а не только их настройки.
— Опыт эксплуатации .NET-сервисов в Linux-контейнерах: диагностика производительности, память, health checks, graceful shutdown.
— Готовность работать в компактной команде рядом с разработчиками, участвовать в проектировании и code review инфраструктурной части.
— Умение документировать системы понятно для коллег и аргументировать технические решения.
— Будет преимуществом опыт работы в корпоративной среде с повышенными требованиями к ИБ, traceability и релизному контролю.
Условия:
— Субсидирование ипотечного кредитования.
— Льготные путевки в собственный санаторий.
— Ежегодная индексация.
— Расширенная ДМС (после испытательного срока).
— Корпоративная программа пенсионного обеспечения.
— Дополнительные выплаты: поддержка многодетных родителей, выплата при рождении ребенка.
— Офис в пешей доступности от станции Сколково.
— Корпоративный транспорт от м. Тропарево и от м. Новопеределкино.
— График работы: с 8:30 до 17:00, пятница до 16:00.