Задачи:
— Владение, развитие и эксплуатация облачной инфраструктуры AWS, включая вычисления, сеть, хранилища и управляемые сервисы
— Проектирование и поддержка инфраструктуры с высокой доступностью, предсказуемой производительностью и финансовой корректностью
— Ведение архитектурных решений на уровне платформы, включая миграции сервисов и изменения среды выполнения (например, Redis → Valkey, EKS → ECS/Fargate)
— Обеспечение соответствия инфраструктурных решений требованиям надежности, стоимости и простоты эксплуатации
— Проектирование и поддержка безопасных, повторяемых и наблюдаемых конвейеров развертывания
— Ответственность за надежность системы через планирование емкости, моделирование отказов и контролируемое управление изменениями
— Руководство реагированием на инциденты и анализом корневых причин сбоев инфраструктуры
— Участие в дежурствах и постоянное улучшение эргономики эксплуатации
— Создание и поддержка сильной наблюдаемости инфраструктуры и сервисов (метрики, логи, трассировка, оповещения)
— Обеспечение безопасной конфигурации ресурсов AWS, политик IAM, управления секретами и сетевых границ
— Проактивное выявление и устранение рисков инфраструктуры, связанных с масштабированием, стоимостью или безопасностью
— Техническое лидерство и сотрудничество с инженерами приложений для понимания ограничений и возможностей платформы
— Ведение изменений инфраструктуры через практическую реализацию
— Установление стандартов и лучших практик для инфраструктуры, развертывания и эксплуатации
— Наставничество других инженеров платформы и повышение операционной зрелости организации
Требования:
— Опыт работы 8+ лет в построении и эксплуатации производственной инфраструктуры в облачных средах
— Глубокий опыт работы с основными сервисами AWS (EC2, ECS/EKS, VPC, IAM, RDS, ElastiCache, ALB/NLB, CloudWatch и др.)
— Сильное понимание контейнеризированных рабочих нагрузок и компромиссов оркестрации
— Опыт проектирования систем с высокой доступностью, отказоустойчивостью и контролируемыми отказами
— Практический опыт инфраструктуры как кода (Terraform, CloudFormation или эквивалент)
— Способность планировать и безопасно выполнять миграции инфраструктуры
— Опыт отладки реальных производственных инцидентов, связанных с сетью, масштабированием или деградацией сервисов
Преимущества:
— Опыт эксплуатации инфраструктуры для финансовых систем или других высоконадежных областей
— Опыт масштабирования инфраструктуры в периоды быстрого роста
— Четкие взгляды на наблюдаемость и эксплуатационную гигиену, основанные на прошлом опыте
— Опыт упрощения, снятия с эксплуатации или реархитектуры избыточной инфраструктуры
— Уверенность в работе с приложениями на базе Rails при сохранении инструментальной независимости
Условия:
— Удаленная работа (США)
— Конкурентная зарплата $190,000 - $200,000 в год, в зависимости от опыта
— Щедрый отпуск и праздничная политика компании
— Оплачиваемое работодателем краткосрочное страхование по инвалидности
— Полное медицинское и стоматологическое страхование для сотрудников (с возможностью расширенного покрытия за дополнительную плату сотрудника)
— Программа поддержки ухода за детьми и щедрый отпуск по уходу за ребенком
Контакты работодателя доступны по кнопке «Откликнуться» после входа.