Задачи:
— Обеспечение качества продукта Terraform (покрытие тестами провайдера), контроль расширения процента покрытия.
— Написание автоматизированных тестов для Terraform Provider/CLI/SDK (E2E и интеграционные сценарии).
— Ведение документации (карта покрытия, дашборды и тд.).
— Работа с API продуктов, доступных через Terraform (проверка базовых и advanced сценариев, корнер-кейсы).
— Постановка задач на другие команды и контроль их выполнения.
— Проработка запросов от клиентов (новые функции, баги).
Требования:
— Опыт ручного и автоматизированного тестирования от трех лет.
— Опыт написания интеграционных и E2E тестов.
— Опыт работы с REST\gRPC.
— Опыт разработки авто-тестов (Golang).
— Linux/Mac на уровне администрирования.
Дополнительно приветствуется:
— Опыт построения процессов тестирования продукта с нуля.
— Желание развиваться в области тестирования, а также погружаться в работу всех продуктов платформы.
— Опыт разработки авто-тестов (Python).
— Знания в области виртуализации - Docker, K8s.
Условия:
— Оформление в соответствии с трудовым законодательством РФ;
— Достойный уровень дохода: оклад + годовой бонус;
— Расширенный ДМС со стоматологией;
— Компенсация спорта;
— Штатный терапевт и психолог;
— Гибкий график работы, пятница – сокращенный рабочий день;
— Классный офис в Москве;
— Культура, в основе которой эмпатия, уважение, открытость и свобода строить рабочий процесс так, как считаешь нужным.
— Индивидуальный план развития и обучение за счет компании;
— Возможность вертикального и горизонтального роста;
— Возможность развиваться как эксперту: выступать на мероприятиях, писать статьи.
— Профессиональные сообщества и клубы по интересам;
— Неформальные мероприятия: от футбольного клуба до посиделок с пиццей.
— Льготная программа ипотечного и потребительского кредитования;
— Материальная помощь при рождении детей и других семейных обстоятельствах;
— Бонусы за рекомендации кандидатов на открытые вакансии.
Задачи:
— Прямая работа с CTO: архитектурные и операционные задачи инфраструктуры
— Поддержка и развитие кластеров Kubernetes: ArgoCD, Helm, GitLab CI/CD
— Код на Go: внутренние утилиты и CLI, экспортеры метрик, операторы и хелперы для платформы, правки в сервисах монорепозитория
— Инфраструктура как код — OpenTofu, Ansible
— Сетевой контур: маршрутизация, VPN, DNS, TLS, ingress, firewall, сегментация
— Docker / docker compose — локальные и staging-окружения разработчиков
— Первая линия реакции на инциденты: разбор алертов, эскалация, постмортемы
— Базовое администрирование сервисов — доступы, почта, админки
Требования:
— Kubernetes в проде — не «поднял minikube», а дежурил и чинил
— GitLab CI/CD, ArgoCD, понимание GitOps-подхода
— Сети — TCP/IP, DNS, NAT, VPN, TLS; умение читать tcpdump и не паниковать
— Docker, docker compose
— Ansible, OpenTofu (или Terraform)
— Linux на уровне уверенного администрирования
— Grafana и алертинг — дашборды, метрики и логи, настройка правил алертов, работа с Prometheus / Loki / Alloy
— Сбор метрик с сервисов в Kubernetes — экспортеры и sidecar'ы, ServiceMonitor / scrape-конфиги, обвязка приложений метриками, RED/USE-подход к дашбордам
— Kafka и NATS — не только «настроить», но и понимать семантику доставки, консьюмер-группы, отставание
— Опыт highload и финтеха — платёжные интеграции, деньги, требования к надёжности
— Готовность подключаться к инцидентам вне стандартных часов
— Английский — документация и переписка
Будет плюсом:
— Go — умение писать и поддерживать код, а не только читать: утилиты, экспортеры, правки в сервисах
— Опыт в iGaming
На этой позиции вы будете отвечать за администрирование облачных платформ, автоматизацию CI/CD, Infrastructure as Code, контейнеризированные среды. Важной частью роли станет обеспечение стабильной и эффективной инфраструктуры для BI-сервисов, data-driven приложений и сопутствующих систем.
ОфисseniorЛимассол
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
— Поддержка и развитие CI/CD, Infrastructure as Code и Kubernetes-платформы
— Проектирование и развитие наблюдаемости (Observability): метрики, логи, трейсы, алертинг, дашборды (Prometheus, Grafana, OpenTelemetry, Loki и др.)
— Диагностика и устранение узких мест: профилирование приложений и инфраструктуры, анализ производительности, тюнинг конфигураций K8s, ОС, сетевых компонентов и СУБД
— FinOps и оптимизация затрат: мониторинг и анализ расходов на облачные ресурсы, балансировка между стоимостью и надежностью
— Автоматизация рутинных операций, участие в ревью архитектуры и улучшении стабильности системы
Требования:
— Опыт работы в роли DevOps/SRE/Platform Engineer не менее 2 лет
— Уверенное владение Linux и Kubernetes (эксплуатация, отладка, оптимизация ресурсов, понимание работы контроллеров, CNI, CSI)
— Практический опыт построения и поддержки CI/CD (GitLab CI, GitHub Actions, ArgoCD и др.) и IaC (Terraform, Pulumi)
— Глубокое понимание принципов наблюдаемости и мониторинга: умение проектировать алерты, настраивать сбор метрик/логов/трейсов
— Навыки диагностики производительности: анализ bottlenecks, понимание сетевого стека, балансировки нагрузки
— Опыт работы с облачными платформами (Yandex Cloud, Cloud.ru, AWS/GCP/Azure)
— Знание основ сетевой маршрутизации, DNS, HTTP/gRPC, TLS
Будет плюсом:
— Опыт работы с сервис-мешами (Linkerd/Istio)
— Понимание методологий SRE (SLI/SLO, error budget, incident response, основы chaos engineering)
— Сертификации в области Cloud/Kubernetes/SRE/FinOps
Условия:
— Работа в коллективе ИТ-профессионалов
— Возможность самореализации в амбициозных проектах цифровой трансформации компании-лидера в своей отрасли
— Отсутствие бюрократии и дух стартапа
— Стабильный работодатель
— Достойный уровень оплаты, годовой бонус
— Конкурентоспособный социальный пакет
— Официальное трудоустройство в собственную аккредитованную ИТ компанию со всеми преимуществами
— Гибридный график работы.
As a Principal Infrastructure Architect on our Infrastructure Architecture team, you will be the architecture team's partner to ZoomInfo's data engineering organization. You bring the infrastructure patterns, evaluation rigor, and cross-team alignment that help them build and run those platforms well on GCP.
Develop and maintain Terraform/OpenTofu modules for vSphere VM provisioning, placement/resource-pool configuration, and cloud-init/cloudbase-init integration, following designs defined by the VMware Architect. Create and run Ansible playbooks for post-provisioning configuration handoff on VMware-provisioned VMs.
Группа компаний «ДОМ.РФ» реализует национальные проекты в области жилищного строительства и ипотеки. Более 25 лет занимается развитием жилищной сферы в России. В компании работает более 9 тысяч человек, из которых более 1,5 тысяч — команда цифровой вертикали, проводящая цифровую трансформацию строительной отрасли и создающая инновационные ИТ-продукты.
Задачи:
— Развивать платформу разработки, проектировать и внедрять новые платформенные интеграции как готовый сервис для команд: от идеи до выката, доступов, мониторинга и документации
— Развивать текущий стек: секреты, управляемые БД, Kafka, registry, GitOps, CI/CD, наблюдаемость
— Сопровождать кластеры Kubernetes и платформенные сервисы, разбирать инциденты, поддерживать мониторинг и логирование
— Участвовать в развитии инфраструктуры: виртуальные машины, автоматизация, связанные платформенные компоненты
— Самостоятельно вести задачу до результата: уточнять требования, пушить смежников, эскалировать блокеры
— Оформлять заявки на сетевые доступы, учётные записи, сертификаты и согласования при необходимости
— Работать с продуктовыми командами как с заказчиками платформы и не оставлять интеграции незавершёнными
— Использовать LLM и ИИ-агентов в повседневной работе и развивать эти практики в команде, в том числе через MCP
Требования:
— 5+ лет в инфраструктуре, platform engineering или SRE
— Опыт с Kubernetes в продакшене: операторы, Helm, сеть, хранилище, RBAC, разбор инцидентов
— GitOps на практике: инфраструктура и сервисы описываются в Git, изменения идут через merge request, а не руками в кластере
— Опыт с Terraform и/или Ansible
— Опыт интеграций под ключ: Vault, операторы PostgreSQL и Kafka, registry, мониторинг
— Понимание корпоративного контура: сети, DNS, учётные записи, сертификаты, согласования со смежными командами и ИБ
— Умение доводить задачу до результата: заявки, переписка, эскалации
— Активная работа с LLM и ИИ-агентами: разбор инцидентов, код и манифесты, документация, исследование незнакомых API
In this role you will get opportunities to implement and maintain CI/CD systems and developer productivity solutions. Bring your industry experience to improve the efficiency and scale of Dremio’s infrastructure via innovation on tooling and methodologies.
Развёртывание и поддержка тестовых стендов ДБО ФЛ в Docker и Kubernetes; Настройка и поддержка CD-пайплайнов для доставки артефактов от вендора на тестовые контуры;
-Design and develop the software installer — a Go-based CLI that automates provisioning, manifest rendering, image bundling, and end-to-end deployment of Reactor to customer environments, including fully air-gapped networks. -Proficiency in Java, JavaScript, Go, and Bash for building production software — services, systems-level code, and CLI tools.
Задачи:
— эксплуатация продакшена (PHP + MySQL): деплой, мониторинг, SSH-диагностика, логи, cron, инцидент-менеджмент, ротация секретов, документация
— разработка на Go: REST API, Docker, CI
— поднимать прод-сервисы на VPS: деплой, рестарты, логи, health-check
— автоматизировать рутину на Bash + cron: прогрев кэша, отслеживание цен, push-рассылки, пересборка YML-фидов и sitemap
— контейнеризировать сервисы с использованием multi-stage Dockerfile, docker-compose с PostgreSQL
— настраивать CI с GitHub Actions и EAS для мобильных сборок
— диагностировать инциденты, находить причины и восстанавливать сервисы
— ротация секретов без простоя
— вести документацию (DEPLOY.md, CRON.md, PRODUCTION.md, RELEASE_CHECKLIST.md)
— работать с AI-ассистентами: формулировать задачи, проверять результаты, интегрировать в код и инфраструктуру
Требования:
— опыт 2 года в продакшене
— опыт эксплуатации PHP + MySQL
— знание Go, Bash, SQL, Python (базово)
— опыт работы с Linux, SSH, systemd, Nginx, Apache, Docker, Docker Compose, cron
— опыт с CI/CD: GitHub Actions, git-flow
— базовые знания Kubernetes (minikube), Ansible, Terraform (в процессе изучения)
— опыт мониторинга с Prometheus и Grafana (pet-проекты)
— английский B2 (чтение, переписка, документация)
Условия:
— локация: Саратов, Россия (UTC+4)
— формат работы: удалённо, гибрид обсуждается
— занятость: полная
— зарплата: 80 000–120 000 ₽ в месяц
Дополнительно:
— готов к тестовому заданию и собеседованию
— имеет pet-проекты с открытым исходным кодом на GitHub
As the Senior Staff Machine Learning Platform Engineer, you will own the technical vision and evolution of Faire’s ML platform. You will set standards, influence org-wide architecture, and lead complex, cross-functional initiatives that unlock data science velocity at scale.
Build and own an observability platform that ingests customer telemetry — events, logs, and traces — using OpenTelemetry and industry best practices. Deliver dashboarding and visualization capabilities that give Support and Field teams real-time visibility into system health, emerging issues, and trends — and help customers stay resilient at scale.
- Вести инфраструктурные инициативы end-to-end: от проектирования до внедрения и дальнейшей поддержки, включая переход от монолита к гибридной архитектуре; - Развивать платформу на AWS и managed Kubernetes (EKS) и описывать всю инфраструктуру как код на Terraform;