Задачи:
— Развивать и администрировать стек сбора метрик Grafana, Graphite, VictoriaMetrics, Moira.
— Повышать отказоустойчивость и масштабируемость системы.
— Разворачивать и поддерживать решения в Kubernetes, писать и дорабатывать Helm-чарты.
— Осуществлять миграции, обновлять систему.
— Разбираться с инцидентами и их причинами.
— Взаимодействовать с командами разработки по вопросам наблюдаемости сервисов.
Требования:
— Опыт администрирования Linux от двух лет: управление сервисами, настройка окружения, работа по SSH.
— Практический опыт работы с Kubernetes: понимание манифестов и написание Helm-чартов.
— Опыт построения CI/CD пайплайнов.
— Опыт администрирования систем телеметрии: Grafana, VictoriaMetrics, Sentry, Kibana.
— Знание Ansible: написание ролей и плейбуков для автоматизации развертывания.
— Уверенная работа с Git.
— Понимание принципов отказоустойчивости распределенных систем.
— Навыки дебага приложений и инфраструктуры по логам и метрикам.
Контакты работодателя доступны по кнопке «Откликнуться» после входа.