Требования к специалисту:
— Коммерческий опыт в DevOps или SRE от 4 лет.
— Реальный опыт проектирования и построения инфраструктуры с нуля.
— Опыт эксплуатации Docker Swarm в production.
— Уверенное знание и production-опыт Kubernetes.
— Опыт настройки GitLab CI/CD, раннеров и пайплайнов для фронтенда и бэкенда.
— Понимание сетевой модели и проксирования через Nginx.
— Опыт эксплуатации Percona XtraDB Cluster / Galera в production: кворум и split-brain, SST/IST, bootstrap после падения, бэкапы через Percona XtraBackup.
— Опыт работы с Docker, PostgreSQL, Redis и S3-совместимым хранилищем.
— Опыт настройки Prometheus, Grafana, Loki и Zabbix.
— Готовность участвовать в архитектурных решениях, работе с командами разработки и технических переговорах с подрядчиками.
Задачи:
— Спроектировать и развернуть инфраструктуру продукта с нуля.
— Настроить CI/CD пайплайны для фронтенда и бэкенда.
— Поднять и сопровождать кластер Docker Swarm и процессы деплоя.
— Спроектировать и провести миграцию на Kubernetes после завершения переезда.
— Администрировать Percona XtraDB Cluster: отказоустойчивость, бэкапы и восстановление.
— Настроить мониторинг, алертинг и логирование.
— Работать с командами разработки и участвовать в технических переговорах с подрядчиками.
Требования к специалисту:
— Практический опыт работы с Docker/docker-compose;
— Опыт с Qdrant, REST/gRPC и Qdrant Cloud;
— Развёртывание и конфигурирование программных компонентов;
— Подключение сервисов;
— Диагностика вопросов, возникающих при развёртывании.
Задачи:
— Развёртывание Qdrant;
— Подключение клиентов;
— Настройка REST/gRPC и веб-дашборда;
— Диагностика ошибок запуска;
— Контейнеризация и интеграция сервисов.
Удалённоmiddle
160 – 180
Ккрупный продукт в сфере online entertainment и общения
Задачи:
— поддерживать и развивать инфраструктуру продукта на Linux;
— обеспечивать стабильную работу серверов, прокси и CDN;
— обеспечивать доступность продукта для пользователей из разных стран;
— автоматизировать инфраструктурные процессы и развивать CI/CD;
— развивать мониторинг и участвовать в расследовании инцидентов;
— участвовать в разработке внутренних инструментов.
Требования:
— уверенное знание Linux;
— работа с bare-metal;
— опыт эксплуатации production-инфраструктуры;
— опыт работы с Nginx;
— опыт автоматизации рутинных задач;
— умение самостоятельно находить причины сложных технических проблем;
— опыт с MongoDB, ClickHouse, Prometheus, Grafana (будет плюсом);
— опыт с GitHub Actions или другими CI/CD-системами (будет плюсом);
— опыт с Docker (будет плюсом);
— знание Python или Bash (будет плюсом).
Условия:
— оформление по ТК РФ;
— офис / гибрид / полная удалёнка;
— ДМС со стоматологией;
— всё необходимое оборудование;
— компенсация профессионального развития;
— компенсация изучения английского языка.
ОфисСанкт-Петербург
200 000 – 220 000 ₽
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
— Прямая работа с CTO: архитектурные и операционные задачи инфраструктуры
— Поддержка и развитие кластеров Kubernetes: ArgoCD, Helm, GitLab CI/CD
— Код на Go: внутренние утилиты и CLI, экспортеры метрик, операторы и хелперы для платформы, правки в сервисах монорепозитория
— Инфраструктура как код — OpenTofu, Ansible
— Сетевой контур: маршрутизация, VPN, DNS, TLS, ingress, firewall, сегментация
— Docker / docker compose — локальные и staging-окружения разработчиков
— Первая линия реакции на инциденты: разбор алертов, эскалация, постмортемы
— Базовое администрирование сервисов — доступы, почта, админки
Требования:
— Kubernetes в проде — не «поднял minikube», а дежурил и чинил
— GitLab CI/CD, ArgoCD, понимание GitOps-подхода
— Сети — TCP/IP, DNS, NAT, VPN, TLS; умение читать tcpdump и не паниковать
— Docker, docker compose
— Ansible, OpenTofu (или Terraform)
— Linux на уровне уверенного администрирования
— Grafana и алертинг — дашборды, метрики и логи, настройка правил алертов, работа с Prometheus / Loki / Alloy
— Сбор метрик с сервисов в Kubernetes — экспортеры и sidecar'ы, ServiceMonitor / scrape-конфиги, обвязка приложений метриками, RED/USE-подход к дашбордам
— Kafka и NATS — не только «настроить», но и понимать семантику доставки, консьюмер-группы, отставание
— Опыт highload и финтеха — платёжные интеграции, деньги, требования к надёжности
— Готовность подключаться к инцидентам вне стандартных часов
— Английский — документация и переписка
Будет плюсом:
— Go — умение писать и поддерживать код, а не только читать: утилиты, экспортеры, правки в сервисах
— Опыт в iGaming
Задачи:
— Разворачивать торговые приложения, настраивать инстансы и окружение под требования к нагрузке и задержкам.
— Исследовать и устранять проблемы производительности Linux, сети и сервисов в тестовых окружениях и production.
— Строить воспроизводимые тесты и бенчмарки, проверять влияние изменений на задержки, пропускную способность и потребление ресурсов.
— Автоматизировать инфраструктуру с помощью Ansible и CI/CD.
— Поддерживать инфраструктурные сервисы, настраивать и оптимизировать Kafka.
Требования:
— Опыт настройки и эксплуатации Linux-инстансов в production.
— Практический опыт поиска и устранения проблем производительности на уровне ОС, сети и сервисов.
— Построение воспроизводимых тестов и бенчмарков, оценка влияния изменений на задержки и пропускную способность.
— Автоматизация инфраструктуры с Ansible и CI/CD.
— Настройка мониторинга и алертинга для production-систем.
Будет плюсом:
— Опыт в HFT или других системах с жёсткими требованиями к задержкам.
— Linux performance tuning и работа с perf, eBPF/bpftrace, strace.
— Опыт оптимизации производительности Kafka.
— Разработка инструментов диагностики и автоматизации на Python, Go или C++.
Описание вакансии Ищем начинающего DevOps-инженера с перспективой профессионального роста внутри команды. Задачи: поддержка Linux-серверов и CI/CD, работа с Docker и GitLab Runner, автоматизация инфраструктуры с помощью Ansible, настройка мониторинга, сетей и внутренних сервисов.
На этой позиции вы будете отвечать за администрирование облачных платформ, автоматизацию CI/CD, Infrastructure as Code, контейнеризированные среды. Важной частью роли станет обеспечение стабильной и эффективной инфраструктуры для BI-сервисов, data-driven приложений и сопутствующих систем.
– Участие в развитии и эксплуатации Developer Platform на базе Kubernetes: развертывание, масштабирование, оптимизация кластеров, включая настройку сетевых политик и безопасности с помощью Cilium; – Настройка и поддержка CI/CD-пайплайнов с использованием GitLab CI, автоматизация процессов сборки, тестирования и деплоя приложений;
Группа компаний «ДОМ.РФ» реализует национальные проекты в области жилищного строительства и ипотеки. Более 25 лет занимается развитием жилищной сферы в России. В компании работает более 9 тысяч человек, из которых более 1,5 тысяч — команда цифровой вертикали, проводящая цифровую трансформацию строительной отрасли и создающая инновационные ИТ-продукты.
Задачи:
— Развивать платформу разработки, проектировать и внедрять новые платформенные интеграции как готовый сервис для команд: от идеи до выката, доступов, мониторинга и документации
— Развивать текущий стек: секреты, управляемые БД, Kafka, registry, GitOps, CI/CD, наблюдаемость
— Сопровождать кластеры Kubernetes и платформенные сервисы, разбирать инциденты, поддерживать мониторинг и логирование
— Участвовать в развитии инфраструктуры: виртуальные машины, автоматизация, связанные платформенные компоненты
— Самостоятельно вести задачу до результата: уточнять требования, пушить смежников, эскалировать блокеры
— Оформлять заявки на сетевые доступы, учётные записи, сертификаты и согласования при необходимости
— Работать с продуктовыми командами как с заказчиками платформы и не оставлять интеграции незавершёнными
— Использовать LLM и ИИ-агентов в повседневной работе и развивать эти практики в команде, в том числе через MCP
Требования:
— 5+ лет в инфраструктуре, platform engineering или SRE
— Опыт с Kubernetes в продакшене: операторы, Helm, сеть, хранилище, RBAC, разбор инцидентов
— GitOps на практике: инфраструктура и сервисы описываются в Git, изменения идут через merge request, а не руками в кластере
— Опыт с Terraform и/или Ansible
— Опыт интеграций под ключ: Vault, операторы PostgreSQL и Kafka, registry, мониторинг
— Понимание корпоративного контура: сети, DNS, учётные записи, сертификаты, согласования со смежными командами и ИБ
— Умение доводить задачу до результата: заявки, переписка, эскалации
— Активная работа с LLM и ИИ-агентами: разбор инцидентов, код и манифесты, документация, исследование незнакомых API
Задачи:
— Обеспечивать доступность и отказоустойчивость продукта в условиях блокировок и сетевых ограничений
— Развивать и поддерживать систему мониторинга и алертинга (Prometheus + Grafana)
— Автоматизировать сборку, деплой и выстраивать CI/CD процессы
— Поддерживать и развивать внутренние сервисы компании (HR-инструменты, антифрод)
— Расследовать инциденты на прод-окружении, выдвигать и проверять гипотезы
Требования:
— Опыт администрирования Linux «руками», работы с Bare Metal и production-инфраструктурой
— Отличное понимание сетей (TCP/IP, DNS, HTTP(S), Proxy) и Nginx
— Опыт работы с Docker, GitHub Actions (или другими CI/CD), Python / Bash
— Опыт работы с мониторингом (Prometheus, Grafana)
— Прагматичный подход: адекватное отношение к отсутствию Kubernetes (работаем с Docker)
— Базовый английский для чтения технической документации
— Опыт единственного DevOps в небольшой компании или бэкграунд в разработке (SRE)
— Опыт работы с MongoDB и ClickHouse
Условия:
— Оформление по ТК РФ в аккредитованной IT-компании
— ДМС со стоматологией
— Компенсация профессионального обучения (100%), английского (100%) и спорта/хобби (50%)
— Предоставление необходимого оборудования
— Гибкий график (начало дня с 8:00 до 11:00)
Мы — технологический стартап, делаем детекцию прокси и VPN по сетевым отпечаткам и DNS-скоринг для антифрода (Не РКН).
Разработка своя, продукт продаётся, есть клиенты.
Название и сайт покажем на первом собеседовании.
Бэкенд на Go — микросервисы, аутентификация, API-ключи, сборщики данных — и исследования: почему резолвер ответил так, где протекает прокси, что видно по DNS-запросам. Про многое из этого в интернете не написано — придётся ставить стенд и смотреть.
Tech Hive UAE, a digital and IT firm based in Dubai, is seeking a Middle DevOps Engineer to join their on-site team. The role involves managing and optimizing infrastructure, automating deployment processes, and ensuring system reliability and scalability. Candidates should have experience with cloud platforms, containerization, CI/CD pipelines, and infrastructure as code tools. Strong problem-solving skills and the ability to collaborate with development teams are essential. The position is located in Dubai, UAE, requiring presence at the company's office.
• Обеспечивать доступность и отказоустойчивость продукта в условиях блокировок и сетевых ограничений. • Развивать и поддерживать систему мониторинга и алертинга (Prometheus + Grafana).