Задачи:
- Планирование и выполнение развертывания инфраструктуры с использованием инструментов автоматизации и лучших практик для обеспечения стабильной и масштабируемой платформы.
- Управление ежедневными операциями, устранение проблем и оптимизация рабочих процессов для поддержания высокой доступности и выполнения целей по уровню сервиса.
- Разработка backend-функций, поддерживающих все платформы (расширение, мобильные и десктопные).
- Взаимодействие с конечными пользователями и разработчиками, поддержка и сбор обратной связи для направления развития продукта.
- Работа с командой по созданию и поддержанию культуры повышения стандартов с каждым новым сотрудником.
- Использование лучших практик AI-инжиниринга для повышения продуктивности разработчиков и скорости разработки — стандартизация AI-поддерживаемых рабочих процессов (кодирование, ревью, отладка, реагирование на инциденты), создание и поддержка внутренних инструментов и подсказок, измерение влияния через метрики доставки и надежности.
Требования:
- Глубокий опыт управления и построения на облачных платформах (AWS, Cloudflare).
- Опыт работы с Kubernetes и смежными технологиями (Istio, Helm Charts).
- Опыт управления конфигурацией инфраструктуры (Terraform, Atlantis).
- Опыт создания CI/CD пайплайнов и ускорения доставки приложений (GitHub Actions, ArgoCD).
- Опыт работы с технологиями наблюдаемости в продакшене (Prometheus, Grafana, Sentry).
- Практический опыт программирования на Go (сети, HTTP, gRPC, OpenTelemetry).
- Экспертиза в реализации принципов SRE с акцентом на поддержание высокой доступности.
- Знакомство с обработкой инцидентов и обязанностями on-call.
- Сильные основы безопасности и практический опыт внедрения лучших практик безопасности в облаке и Kubernetes.
Контакты работодателя доступны по кнопке «Откликнуться» после входа.