Описание вакансии
Задачи:
— Подготовка деплой-пакетов и конфигураций, создание и поддержка Helm-чартов, Kubernetes-манифестов, стандартизация конфигураций; управление секретами, сертификатами и переменными окружения
— Управление инфраструктурой как код (IaC): разработка и поддержка Terraform-модулей, Ansible-ролей для развертывания и настройки инфраструктуры (bare-metal, cloud, виртуализация)
— Администрирование платформ оркестрации: установка, настройка и эксплуатация Kubernetes-кластеров (в том числе управление узлами, сетевыми политиками, storage, обновлениями)
— Настройка наблюдаемости (observability): реализация сбора метрик, логирования и трассировки; настройка мониторинга (Prometheus/Victoria Metrics), алертинга (Alertmanager), визуализации (Grafana); обеспечение выполнения SLO/SLA
— Обеспечение безопасности инфраструктуры: контроль доступа (RBAC, network policies), управление секретами, настройка политик безопасности подов, сканирование уязвимостей образов и конфигураций; участие в DevSecOps-практиках
— Подготовка эксплуатационной документации и реагирование на инциденты: разработка runbook, процедур восстановления, участие в устранении инцидентов и постмортемах; поддержка готовности сервисов к продуктивной эксплуатации
— Оптимизация ресурсов и надежности: мониторинг утилизации ресурсов, планирование емкости, оптимизация затрат (cost management) для облачных и on-prem решений; поддержка регулярных релизов и обновлений
— Взаимодействие с командами разработки: консультирование по DevOps-практикам, совместная работа над архитектурой приложений, внедрение стандартов и инструментов, повышение культуры автоматизации
— Участие в архитектурных решениях и планировании: оценка новых технологий, проектирование инфраструктуры, участие в формировании требований к доступности и производительности, декомпозиция технических задач
Требования:
— Опыт разработки и поддержки CI/CD пайплайнов (Jenkins, GitLab CI)
— Уверенное владение Kubernetes: развертывание, настройка, управление кластерами, работа с Helm, операторами, сетевыми политиками
— Практический опыт с Infrastructure as Code (Terraform, Ansible) — автоматизация развертывания инфраструктуры и конфигураций
— Знание принципов observability: настройка Prometheus/Victoria Metrics, Grafana, Loki/ELK, Alertmanager, трассировка
— Опыт работы с системами управления секретами (Hashicorp Vault, Kubernetes Secrets, внешние хранилища) и сертификатами
— Понимание подходов DevSecOps: управление доступом, network policies, сканирование уязвимостей (SAST/DAST), работа с инструментами безопасности
— Знание Git, работа с ветвлением, стратегии управления релизами
Желательные навыки:
— Опыт внедрения прогрессивных стратегий доставки (canary, blue-green, A/B) с использованием Argo Rollouts, Istio, Flagger
— Знание SQL/NoSQL баз данных (PostgreSQL, MongoDB) на уровне администрирования и оптимизации
— Опыт работы с Kafka (настройка, мониторинг, управление топиками)
— Навыки написания runbook и документации, участие в постмортемах
Контакты работодателя доступны по кнопке «Откликнуться» после входа.