Что нужно делать:
— Осуществлять деплой, обновление и настройку кластеров k8s;
— Администрировать базовые инфраструктурные сервисы: Gitlab, Harbor, Nexus, Trivy, Ansible, Keycloak, s3 minio;
— Заниматься поддержкой системы непрерывной интеграции Gitlab CI;
— Администрировать внутреннюю серверную инфраструктуру компании;
— Осуществлять настройку мониторинга, логирования и бэкапов;
— Курировать написание ролей Ansible;
— Осуществлять базовое администрирование СУБД MySQL, pgSQL, создание кластеров, создание баз, нарезание прав;
— Администрировать балансировщики нагрузки на базе HAproxy, NGINX.
Мы ждём, что ты имеешь:
— Опыт администрирования Linux-систем;
— Опыт администрирования S3 хранилищ;
— Знание принципов IaC, работа с инфраструктурой, как с кодом;
— Опыт работы с Nexus, Harbor на уровне администратора;
— Опыт работы с Gitlab (on-premises) на уровне администратора;
— Опыт подготовки CI/CD обвязки\pipeline;
— Опыт администрирования Kubernetes(on-premises) от 3-х лет;
— Опыт работы с системами автоматизации на базе Ansible, Terraform;
— Опыт работы с балансировщиками нагрузки: HAproxy, nginx.
Будет плюсом:
— Наличие опыта работы с GitOps инструментами;
— Опыт внедрения систем мониторинга серверов и контейнеров;
— Опыт работы с Helm;
— Понимание GitFlow.
Задачи:
— совершенствование существующей инфраструктуры для повышения отказоустойчивости, безопасности и масштабируемости
— усовершенствование системы мониторинга и управления инцидентами с внедрением практик SRE, включая глубокую настройку сетевого мониторинга
— самостоятельное управление облачными и локальными ресурсами с использованием контейнеризации и оркестрации (Docker, Kubernetes)
— автоматизация и поддержка процессов CI/CD (GitLab, TeamCity)
— написание скриптов автоматизации на Bash, применение n8n
— администрирование, установка и настройка Linux (CentOS, Ubuntu)
— создание и поддержка документации по DevOps-процессам и инфраструктуре, включая сетевую схему и политики
— обеспечение сетевой безопасности и сегментации (фаерволы, VPN, анализ сетевой активности)
— участие в экстренном восстановлении сервисов при сбоях (24/7 до "оживления сервиса")
Требования:
Обязательные:
— минимум 5 лет опыта на позиции DevOps Engineer
— навыки администрирования, установки и настройки Linux
— опыт написания скриптов на Bash
— опыт работы с CI/CD инструментами (GitLab CI, TeamCity, Jenkins или аналоги)
— опыт управления облачными и локальными ресурсами с использованием контейнеризации и оркестрации (Docker, Kubernetes не в облаке)
— опыт работы с Nginx
— знания систем автоматизации конфигурации (Terraform, Ansible) и мониторинга (Prometheus, Grafana, OpenSearch)
— опыт работы с S3 Minio, VMware
— понимание основ работы с базами данных (PostgreSQL + Patroni)
— понимание сетевых технологий (сегментация, фаерволы, VPN, маршрутизация, анализ трафика)
— опыт построения геораспределенных и отказоустойчивых кластеров баз данных и Kubernetes (не в облаке)
— умение выявлять проблемы при подключении к VPN и работать с подключённым VPN
— стрессоустойчивость и способность быстро анализировать сложные проблемы в условиях ограниченного времени
Желательные:
— опыт работы в платежных системах с балансом пользователя
— написание скриптов shell, bash, powershell, perl
— опыт работы как сетевой инженер, SRE, инженер внедрения ПАК
— знание Ethernet, TCP/IP, VLAN, модели OSI
— понимание виртуализации QEMU
— сертификаты по информационной безопасности или облачным технологиям
— опыт наставничества или управленческий опыт
Условия:
— работа в офисе в Москве (м. Добрынинская / Серпуховская), удалённой работы нет
— возможен переезд в Белград, Сербия
— график 5/2, 8 часов, начало с 9 до 11, полный день в офисе
— участие в оперативных дежурствах при авариях (компенсируется отгулами), реагирование только на критичные инциденты (1-4 раза в месяц)
— ежемесячный доход выше рынка, обсуждается по итогам интервью
— оплата больничного 14 дней и отпуска 28 дней в размере 100%
— бесплатная парковка у офиса
— релокационный пакет в Москву для специалистов из других городов
— ежегодный пересмотр оплаты на основе рынка
— рабочий ноутбук
— договор на ИП (оплата на р/с)
О проекте
Japanstat создаёт экосистему, которая соединяет весь рынок японских авто: от аукционов в Японии до дилеров и покупателей в России, ОАЭ, Австралии, Африке, Монголии, на Кипре и ещё в десятках стран.
Это сложный B2B-продукт с высокой нагрузкой, данными в реальном времени и десятками интеграций. Инфраструктура здесь напрямую влияет на бизнес клиентов по всему миру.
Кого мы ищем
Мы ищем DevOps-инженера, который уверенно работает с Linux, Kubernetes и CI/CD и хочет отвечать за стабильность высоконагруженного продукта. Для нас важно, чтобы вы были самостоятельным, мыслили системно и легко находили общий язык с разработчиками и QA.
Что предстоит делать
— Строить и развивать CI/CD-пайплайны
— Управлять облачной и серверной инфраструктурой через Infrastructure as Code
— Развивать среду на Docker/Kubernetes: развертывание и масштабирование сервисов
— Настраивать мониторинг, логирование и алертинг, участвовать в разборе инцидентов
— Автоматизировать процессы и делать релизы стабильными
— Оперативно реагировать на инциденты на проде, в том числе вне рабочего времени
Что для нас важно
— Уверенный Linux, сети, понимание веб-сервисов и микросервисной архитектуры
— Практический опыт с Docker и Kubernetes
— CI/CD: GitLab CI, Jenkins или аналоги
— IaC: Terraform, Ansible или аналоги
— Мониторинг и логирование: Prometheus, Grafana и др.
— Git, Bash, базовые навыки Python/Go/Node.js
— Понимание ИБ, управления секретами и доступами
Будет плюсом
— Опыт с high-load / high-availability системами
— Helm, Argo CD, GitOps
— PostgreSQL, Redis, Kafka/RabbitMQ
— Балансировка нагрузки и CDN
— Практики SRE: SLI/SLO/SLA, incident management, postmortem
— FinOps: оптимизация стоимости и производительности облака
Что мы даём
— Полная удаленка из любой точки мира
— Официальное трудоустройство
— Оклад 240 000 ₽ на руки, возможны премии
— Подарки и бонусы от компании на праздники
— График 5/2, 9:00–18:00 по Москве
— Компенсация за реагирование на инциденты вне рабочего времени
— Без регулярных переработок: вне графика — только экстренные инциденты
Удалённо
240 000 – 240 000 ₽
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Обязанности и задачи:
— Развёртывание и эксплуатация Kubernetes-кластеров в production: самостоятельное поднятие кластеров с нуля через Kubespray, понимание архитектуры и взаимодействия компонентов.
— Работа в закрытых контурах: подготовка всех необходимых пакетов, Docker-образов и зависимостей для развёртывания.
— Установка и настройка сервисов в Kubernetes через Helm, доработка и отладка Helm-чартов «на лету» в процессе внедрения у заказчика.
— Диагностика и устранение проблем Kubernetes, Helm, Linux, Container Registry, Ansible, Terraform.
— Полное ведение внедрения: от подготовки инфраструктуры до запуска и дальнейшей эксплуатации продукта у заказчика.
— Развёртывание и поддержка сервисов в Kubernetes: Kafka, ClickHouse, PostgreSQL, Qdrant, Traefik, OpenSearch, NATS, NACK.
— Работа с облачными платформами VK Cloud и OpenStack.
Требования:
— Уровень: Middle+
— Опыт работы: 4-5 лет
— Готовность к очному выезду к заказчикам в Москве для внедрения продукта в закрытых контурах (60% удаленно, 40% onsite).
— Практический опыт развертывания и эксплуатации Kubernetes в production.
— Уверенное владение Kubespray — самостоятельное развертывание кластера с нуля, понимание работы архитектурных компонентов и их взаимодействия.
— Опыт работы в закрытых (air-gapped) контурах без доступа к интернету.
— Умение самостоятельно подготовить все необходимые пакеты, образы и зависимости для offline-развертывания.
— Опыт установки и настройки сервисов в Kubernetes через Helm.
— Умение дебажить и дорабатывать Helm-чарты «на лету» в процессе внедрения.
— Уверенное знание Linux, Ansible, Terraform, Docker/Container Registry.
— Навыки диагностики и устранения проблем Kubernetes, Helm, Linux.
— Опыт внедрения решений у заказчиков.
— Способность самостоятельно доводить внедрение от подготовки инфраструктуры до запуска и эксплуатации продукта.
— Будет плюсом опыт работы с VK Cloud и OpenStack.
— Опыт работы с различными БД и сервисами в Kubernetes: Kafka, ClickHouse, PostgreSQL, Qdrant, Traefik, OpenSearch, NATS, NACK.
— Опыт работы с KubeRay Operator, NVIDIA Device Plugin.
— Умения настраивать ноды с GPU (nvidia-container-toolkit).
Условия:
— Карьерная и профессиональная возможность в стабильной, аккредитованной ИТ-компании.
— Расширенный полис ДМС со стоматологией, корпоративный психолог.
— Необходимая техника для комфортной работы.
— Обучение, сертификацию, Usetech English Club – онлайн изучение английского.
— Доступ к Корпоративной библиотеке и к Корпоративному университету.
— Внутрикорпоративные профильные комьюнити.
— Забота о детях сотрудников: корпоративные скидки, подарки, детские дни.
— Геймифицированную программу лояльности с корпоративным магазином.
— Корпоративную жизнь с балансом работы и отдыха.
Обо мне:
DevOps-инженер с коммерческим опытом сопровождения production-систем, высоконагруженных банковских сервисов и платформы AI-агентов. Специализируюсь на Kubernetes, автоматизации инфраструктуры через Terraform и Ansible, развитии CI/CD, мониторинге и логировании.
Работал с облачными и закрытыми on-premise-контурами. Участвовал в проектировании инфраструктуры, проведении релизов, устранении production-инцидентов и повышении надёжности сервисов.
Ключевые результаты и опыт:
- Спроектировал отказоустойчивую Kubernetes-платформу для production-сервисов обработки текстовых и голосовых обращений.
- Стандартизировал CI/CD для 35+ микросервисов на базе GitLab CI/CD, Helm и Argo CD, сократив среднее время релиза с 35 до 8 минут.
- Автоматизировал развёртывание облачной и on-premise-инфраструктуры через Terraform и Ansible, сократив подготовку клиентского контура с двух рабочих дней до 90 минут.
- Построил observability-платформу на Prometheus, VictoriaMetrics, Grafana, Loki и Alertmanager, сократив среднее время восстановления сервисов с 50 до 18 минут.
- Разработал стратегию резервного копирования PostgreSQL, S3-совместимых хранилищ и Kubernetes-ресурсов с использованием WAL-G и Velero.
- Переработал Jenkins pipelines и Helm-чарты для 50+ банковских сервисов, сократив время типового релиза с 40 до 12 минут.
- Внедрил canary-развёртывания и автоматическую проверку health-метрик после релиза.
- Настроил мониторинг и централизованное логирование для Kubernetes, Kafka, PostgreSQL, Redis и прикладных сервисов.
- Интегрировал HashiCorp Vault с CI/CD и Kubernetes для централизованного управления секретами.
- Участвовал в устранении production-инцидентов, проводил RCA и актуализовал runbook-инструкции.
Образование высшее
Английский язык: B2.
Задачи:
- Планирование и выполнение развертывания инфраструктуры с использованием инструментов автоматизации и лучших практик для обеспечения стабильной и масштабируемой платформы.
- Управление ежедневными операциями, устранение проблем и оптимизация рабочих процессов для поддержания высокой доступности и выполнения целей по уровню сервиса.
- Разработка backend-функций, поддерживающих все платформы (расширение, мобильные и десктопные).
- Взаимодействие с конечными пользователями и разработчиками, поддержка и сбор обратной связи для направления развития продукта.
- Работа с командой по созданию и поддержанию культуры повышения стандартов с каждым новым сотрудником.
- Использование лучших практик AI-инжиниринга для повышения продуктивности разработчиков и скорости разработки — стандартизация AI-поддерживаемых рабочих процессов (кодирование, ревью, отладка, реагирование на инциденты), создание и поддержка внутренних инструментов и подсказок, измерение влияния через метрики доставки и надежности.
Требования:
- Глубокий опыт управления и построения на облачных платформах (AWS, Cloudflare).
- Опыт работы с Kubernetes и смежными технологиями (Istio, Helm Charts).
- Опыт управления конфигурацией инфраструктуры (Terraform, Atlantis).
- Опыт создания CI/CD пайплайнов и ускорения доставки приложений (GitHub Actions, ArgoCD).
- Опыт работы с технологиями наблюдаемости в продакшене (Prometheus, Grafana, Sentry).
- Практический опыт программирования на Go (сети, HTTP, gRPC, OpenTelemetry).
- Экспертиза в реализации принципов SRE с акцентом на поддержание высокой доступности.
- Знакомство с обработкой инцидентов и обязанностями on-call.
- Сильные основы безопасности и практический опыт внедрения лучших практик безопасности в облаке и Kubernetes.
Задачи:
— Обеспечение надежности, масштабируемости и производительности распределенной инфраструктуры ZK-сопроцессоров.
— Управление парком блокчейн-нод (RPC, Validators) и специализированных Prover-нод в мультичейн среде.
— Автоматизация процессов развертывания и управления инфраструктурой (IaC) с использованием Terraform / Pulumi.
— Глубокий мониторинг и алертинг (Prometheus, Grafana, VictoriaMetrics) с фокусом на специфические метрики блокчейна и прувинга.
— Оптимизация производительности систем (Performance Tuning) и работа над минимизацией сетевых задержек (low-latency).
— Управление инцидентами, проведение Post-mortem анализа и разработка мер по предотвращению повторных сбоев.
— Внедрение и развитие практик GitOps и CI/CD пайплайнов для инфраструктурных и прикладных сервисов.
Требования:
— Опыт работы в роли SRE или DevOps Engineer от 4-5 лет.
— Экспертное владение Kubernetes (управление кластерами, написание Helm чартов / Operator SDK).
— Глубокие знания Linux internals, сетевых протоколов и безопасности.
— Опыт работы с облачными провайдерами (AWS — основной, GCP/Azure).
— Уверенное владение Python или Go для написания инструментов автоматизации.
— Практический опыт работы с инструментами IaC (Terraform).
— Английский язык: Upper-Intermediate (свободная коммуникация в международной команде).
Будет плюсом:
— Опыт эксплуатации блокчейн-инфраструктуры (Ethereum, L2s, Solana).
— Понимание специфики работы ZK-Rollups или систем с интенсивными вычислениями (GPU/FPGA acceleration).
— Опыт работы с инструментами распределенной трассировки (Jaeger / Tempo).
ООО "Почтовые финансы" – Центр единого сервиса для ДЗО холдинга "Почта России". Ключевые области работы: логистика, электронная коммерция, IT, банки, финтех. Компания создана в 2021 году для ИТ-поддержки и сопровождения деятельности АО "Почта России". Более 3000 человек в 82 регионах присутствия.
Задачи:
— Осуществлять техническую поддержку и консультирование пользователей по вопросам эксплуатации корпоративной облачной платформы.
— Проводить диагностику и устранение неисправностей.
— Разрабатывать пошаговые руководства по решению типовых проблем.
— Разъяснять функционал систем и сервисов.
— Вести базу обращений пользователей (Service Desk): регистрировать заявки, отслеживать статусы выполнения, закрывать заявки после решения проблемы, формировать отчёты по статистике обращений.
— Выполнять установку, настройку и подключение программных компонентов корпоративной облачной платформы.
— Проводить профилактические работы и обновление ПО.
Требования:
— Высшее техническое образование.
— Опыт администрирования гипервизоров на базе KVM и/или OpenStack не менее 3 лет ОБЯЗАТЕЛЕН.
— Понимание принципов работы различных платформ виртуализации.
— Знание OpenStack (Nova, Neutron, Cinder, Glance, Keystone).
— Опыт работы с Ceph или подобными SDS, а также аппаратными СХД в связке с cinder.
— Опыт работы с MariaDB Galera Cluster (синхронная репликация, split-brain, кворум) либо аналогичными кластеризованными решениями.
— Опыт работы с HAProxy + Keepalived (L4/L7 балансировка, SSL termination, VIP).
— Опыт работы с Apache2 (WSGI для OpenStack API, тюнинг воркеров).
— Опыт работы с RabbitMQ (очереди сообщений control plane).
— Знание Linux Networking (iproute2, iptables/nftables, namespaces, OVS/OVN, VLAN/VXLAN).
— Навыки автоматизации: Ansible, Terraform, Python/Bash, puppet.
— Опыт мониторинга: Prometheus, Grafana (или VictoriaMetrics).
— Умение работать в команде, активная жизненная позиция, ответственность.
Условия:
— Официальное трудоустройство согласно Трудовому законодательству.
— Стабильный белый доход в государственной компании федерального уровня.
— ДМС со стоматологией (подключение пакета после успешного прохождения испытательного срока).
— Заработная плата: оклад 256000 руб. + годовая премия по итогу выполнения ключевых показателей эффективности.
— График работы: 5/2 с 9.00 до 18.00 (суббота, воскресенье - выходные).
— Формат работы обсуждается: офис/гибрид/удалёнка.
— Отличные условия труда и коллектив.
About the Team
The Security Operations team protects CircleCI’s infrastructure, product, and customer data against evolving threats, working closely with engineering to maintain security and resilience.
About the Role
As a Security Operations Engineer, you will protect CircleCI’s infrastructure, product, and customer data from AI-driven attacks and defenses. This intermediate role involves ownership of security challenges, collaboration with Engineering, contributing to the security roadmap, and leveraging AI tools to detect, respond to, and automate security threats.
What You’ll Do:
Threat Detection & Incident Response
— Monitor, investigate, and respond to security threats across cloud and application environments using security and AI-assisted tools.
— Participate in risk assessments, incident response, post-incident reviews, and on-call support, improving controls and processes.
Security Engineering & Architecture
— Build and maintain security tooling, controls, and automation across cloud, application, and CI/CD environments following best practices.
— Identify vulnerabilities and configuration risks, contribute to runbooks and compliance, and understand CircleCI’s security architecture.
AI & Security
— Incorporate AI-powered security tools into workflows and evaluate emerging technologies for detection, response, and automation.
— Stay current on AI-specific security threats and contribute to responsible AI use in security operations.
Cross-Team Partnership & Ownership
— Partner with Engineering teams to understand security needs, provide guidance, and translate risks into actionable recommendations.
— Contribute to security roadmap planning, technology evaluations, and documentation while building relationships across teams.
What You’ll Bring:
— 3+ years of security engineering or operations experience or equivalent expertise.
— Hands-on experience with cloud, application, and CI/CD security in AWS, GCP, or Azure.
— Experience with incident response and security tools including EDR, CNAPP, SASE, vulnerability scanners, and log analysis.
— Ability to build and maintain security automation and tooling using Go, Python, or Terraform.
— Strong security judgment and problem-solving skills.
— Hands-on experience with AI/ML-powered security tools in production and understanding of AI’s role in security workflows.
Bonus Skills (Nice to Have):
— Familiarity with AI-specific threat categories like prompt injection and model supply chain risks.
— Experience securing developer platforms, SaaS, or CI/CD infrastructure.
— Relevant certifications such as CEH, AWS Security Specialty, Security+.
— Contributions to process improvement, runbook development, or knowledge sharing.
Accommodation
CircleCI provides reasonable accommodation for individuals with disabilities during application and employment.
About CircleCI
CircleCI is the world’s largest CI/CD platform, processing over 3 million jobs daily, helping companies leverage AI in software delivery. Founded in 2011, headquartered in San Francisco with a global remote workforce, and venture-backed by multiple investors.
Equal Opportunity
CircleCI is an Equal Opportunity and Affirmative Action employer, not discriminating based on legally protected characteristics and considering applicants with criminal histories consistent with laws.
Задачи:
— Проектировать, внедрять и управлять решениями и контролями безопасности для AWS и Kubernetes, включая методы изоляции для платформы RCE-as-a-Service.
— Создавать, развёртывать и поддерживать инфраструктуру как код с использованием Terraform, обеспечивая высокие стандарты безопасности.
— Проводить оценки безопасности, моделирование угроз и аудиты AWS и Kubernetes.
— Сотрудничать с командами разработки и эксплуатации для внедрения лучших практик безопасности в CI/CD.
— Мониторить и реагировать на инциденты безопасности в облаке, выявлять причины и рекомендовать меры по устранению.
— Обеспечивать соответствие требованиям комплаенса (SOC 2, ISO 27001, GDPR, HIPAA, PCI DSS).
— Наставлять инженеров и продвигать культуру облачной безопасности в организации.
Требования:
— Опыт работы в облачной безопасности не менее 5 лет, глубокие знания AWS.
— Профессиональные навыки в области безопасности Kubernetes: защита кластеров, RBAC, сетевые политики, управление уязвимостями контейнеров.
— Экспертное владение Terraform.
— Знание сервисов безопасности AWS (IAM, GuardDuty, Security Hub, CloudTrail, WAF).
— Знакомство с CNAPP решениями (Wiz) и SIEM (Panther).
— Понимание безопасного жизненного цикла разработки ПО, безопасности CI/CD и DevSecOps.
— Желательны сертификаты AWS Certified Security – Specialty, Certified Kubernetes Security Specialist (CKS), Terraform Associate.
— Приветствуются сертификаты SANS или OffSec.
— Отличные навыки решения проблем, коммуникации и лидерства.
Условия:
— Удалённая работа из США (SF, NYC или Remote).
— Конкурентная зарплата и пакет вознаграждений, включая акции, медицинские льготы и гибкий отпуск.
Дополнительно:
— Работа в команде инженеров, тесное сотрудничество с командой безопасности.
— Технологический стек включает Typescript, React, Apollo GraphQL, Redux, Express, Postgres, Redis, Kubernetes, Terraform, Helm, AWS.
Задачи:
— Развертывание и эксплуатация Bitcoin Core nodes.
— Построение отказоустойчивой инфраструктуры для backend-сервисов.
— Мониторинг состояния Bitcoin-нод и внутренних сервисов.
— Настройка metrics, logging, alerting и dashboards.
— Secrets management и безопасная работа с credentials.
— Backup и disaster recovery.
— Автоматизация deployment и infrastructure provisioning.
— CI/CD.
— Контроль доступов и сегментация инфраструктуры.
— Анализ и устранение production-инцидентов.
— Capacity planning и оптимизация ресурсов.
— Совместная работа с security engineer над hardening инфраструктуры.
Требования:
— Опыт DevOps/SRE в production-системах.
— Linux на уверенном уровне.
— Docker и контейнерная инфраструктура.
— Опыт с Kubernetes или аналогичными orchestration-платформами.
— Infrastructure as Code: Terraform, Ansible или аналоги.
— Опыт построения monitoring/alerting систем.
— Понимание сетей, firewall, TLS и управления доступом.
— Практический опыт secrets management.
— Опыт построения backup/recovery процессов.
— Умение расследовать production-инциденты.
Будет плюсом:
— Опыт эксплуатации Bitcoin Core nodes.
— Понимание Bitcoin P2P/networking.
— Опыт эксплуатации blockchain infrastructure.
— Опыт с security-sensitive или financial infrastructure.
— Опыт защиты публичных сервисов от DDoS/DoS.
— Опыт построения privacy-oriented инфраструктуры.
Что важно в этой роли:
Для проекта критична не только доступность сервисов, но и минимизация инфраструктурных рисков и утечек метаданных. Поэтому нам нужен инженер, который рассматривает security и privacy как часть инфраструктурной архитектуры, а не как отдельный этап после запуска.
Задачи:
— Проектирование, внедрение и поддержка DevOps-инструментов для дата-пайплайнов и платформ.
— Поддержка и автоматизация ETL-воркфлоу (например, Spark, Airflow).
— Создание и управление мониторингом и наблюдаемостью качества данных (DBT), дата-пайплайнов и систем хранения.
— Внедрение и поддержка инфраструктуры хранения данных на AWS (S3, EC2, сеть).
— Интеграция и поддержка Project Nessie как транзакционного каталога для Data Lakes с семантикой, похожей на Git.
— Тесное взаимодействие с Data Engineers для обеспечения плавного деплоя, версионирования и масштабирования дата-задач и пайплайнов.
— Автоматизация деплоя и CI/CD процессов с использованием GitLab CI/CD.
— Обеспечение лучших практик безопасности при работе с чувствительными данными.
— Написание автоматизации инфраструктуры на Python, Bash, Ansible.
— Документирование систем, пайплайнов и DevOps-процессов.
Требования:
— Опыт 5+ лет в DevOps / IT Ops / DataOps с практическим опытом работы с инфраструктурой, связанной с данными.
— Глубокие знания Linux (сеть, настройка ядра, оптимизация производительности).
— Практический опыт работы с Airflow, ClickHouse, DBT, Spark и Project Nessie.
— Солидные знания AWS (S3, EC2, IAM, сеть).
— Владение скриптингом и автоматизацией (Python, Bash, Ansible).
— Опыт работы с CI/CD пайплайнами (GitLab).
— Опыт с мониторинговыми стеками (Prometheus, Grafana, ELK).
— Знакомство с контейнеризацией и оркестрацией (Docker, Kubernetes).
— Понимание концепций управления данными.
— Сильные коммуникативные навыки и проактивный подход.
Желательно:
— Опыт работы с потоковой обработкой данных в реальном времени.
— Знание инфраструктуры как кода (Terraform).
— Знакомство с безопасностью в дата-инжиниринге (IAM, шифрование, контроль доступа).
— Опыт работы с высокопроизводительными системами или в торговой среде.
Задачи:
— проектирование, масштабирование и автоматизация сред (Prod/Stage/Test) через IaC (Terraform, Ansible)
— развитие и поддержка кластеров Kubernetes и Docker
— развитие пайплайнов в GitLab CI/CD для ускорения доставки кода
— развитие мониторинга, логов и алертинга (Grafana, Loki, Sentry)
— расследование production-сбоев, разбор причин, повышение отказоустойчивости
— внедрение DevOps-стандартов, инфраструктурное ревью, помощь разработчикам
Требования:
— опыт от 4 лет в DevOps/SRE, опыт в качестве Team lead
— уверенный Linux, Docker, Kubernetes
— практический опыт с GitLab CI, Terraform и Ansible
— опыт работы со связкой Grafana, Loki, Sentry
— умение расследовать инциденты и выстраивать отказоустойчивую архитектуру
Будет плюсом:
— опыт в Highload / Fintech проектах
— знание практик SRE (SLI/SLO, error budget)
— знание Python, Go или Bash
Условия:
— официальное оформление по ТК РФ, полностью «белая» зарплата
— IT-аккредитация (право на IT-ипотеку и отсрочку)
— ДМС после испытательного срока
— гибридный формат работы (3 дня в офисе, 2 — удалённо)
— возможность собрать команду под себя, влиять на технические решения и развитие инфраструктуры
Задачи:
— Администрирование, конфигурация, оптимизация и поддержка платформы Databricks.
— Управление рабочими пространствами Databricks в средах разработки, тестирования и продакшена.
— Конфигурация и управление кластерами, пулами, заданиями и рабочими процессами для поддержки ETL, потоковых и ML задач.
— Мониторинг состояния платформы, емкости и производительности, проактивное выявление и устранение проблем.
— Управление версиями Databricks runtime, библиотеками и интеграциями с облачным хранилищем и сервисами данных.
— Реализация и поддержка процедур резервного копирования, восстановления и обеспечения непрерывности бизнеса.
— Настройка и поддержка управления идентификацией и доступом (IAM) в Databricks.
— Внедрение и соблюдение лучших практик безопасности, включая шифрование, сетевой контроль и политики доступа к данным.
— Сотрудничество с командами безопасности и соответствия для соблюдения организационных и нормативных требований.
— Поддержка стандартов управления данными (например, Unity Catalog).
— Оптимизация конфигураций кластеров, автоскейлинга и планирования заданий для баланса производительности и затрат.
— Анализ метрик использования и затрат, внедрение стратегий контроля затрат.
— Рекомендации и реализация стратегий настройки и оптимизации платформы для больших данных.
— Взаимодействие с инженерами данных, аналитиками и дата-сайентистами для понимания требований и рекомендаций по использованию Databricks.
— Предоставление поддержки уровня Tier 2/3 по инцидентам и запросам, связанным с Databricks.
— Разработка и поддержка документации, инструкций и стандартных операционных процедур.
— Проведение обучения пользователей и обмен знаниями по возможностям и лучшим практикам Databricks.
— Автоматизация развертывания рабочих пространств и кластеров, конфигураций и политик с использованием Infrastructure as Code (Terraform, ARM/Bicep, CloudFormation).
— Интеграция Databricks с CI/CD пайплайнами для развертывания кода и управления средами.
— Поддержка лучших практик контроля версий для ноутбуков, заданий и конфигураций.
Требования:
— Высшее образование в области компьютерных наук, информационных систем, инженерии или смежных областях либо дополнительный опыт работы 4 года при отсутствии диплома.
— Опыт работы не менее 8 лет в администрировании облачных платформ данных или сред больших данных.
— Практический опыт администрирования Databricks (Azure, AWS или GCP Databricks).
— Глубокое понимание рабочих пространств, кластеров, заданий, пулов и ноутбуков Databricks.
— Знание облачных хранилищ (Azure Data Lake Storage, S3, GCS) и сетевых концепций.
— Опыт управления идентификацией и доступом в соответствующем облачном провайдере (Azure AD, IAM и др.).
— Навыки скриптинга и автоматизации (Python, PowerShell, Bash).
— Знакомство с концепциями Spark (кластеры, исполнители, задания, партиции) и вопросами производительности.
— Опыт мониторинга и устранения проблем с производительностью и надежностью платформы.
— Сильные аналитические и проблемно-ориентированные навыки.
— Умение объяснять сложные технические концепции технической и нетехнической аудитории.
— Ориентация на клиента и качество сервиса.
— Способность работать самостоятельно и в команде в динамичной agile-среде.
Желательные квалификации:
— Сертификация Databricks (например, Databricks Certified Data Engineer Associate/Professional, Lakehouse Fundamentals, Administrator).
— Опыт работы с Unity Catalog и тонкой настройкой доступа к данным.
— Опыт работы с CI/CD инструментами (Azure DevOps, GitHub Actions, Jenkins).
— Опыт работы с Infrastructure as Code (предпочтительно Terraform).
— Опыт работы с инструментами агрегации логов и мониторинга (Azure Monitor, CloudWatch, Datadog, Splunk).
— Знание Delta Lake, структурированного стриминга и архитектур Lakehouse.
— Опыт работы в корпоративных средах с высокими требованиями к безопасности и соответствию.
Условия:
— Удаленная работа из любой точки.
— Полная занятость, 40 часов в неделю.
— Требуется получение и поддержание уровня безопасности Public Trust с обязательной процедурой снятия отпечатков пальцев.
— Требования к резидентству в США: проживание в США или территориях последние 5 лет с ограничениями на время отсутствия.
— Конкурентная зарплата в диапазоне $10,669 – $14,435 в месяц ($128,039 - $173,229 в год), зависит от опыта и местоположения.
— Пакет социальных льгот, включая медицинское страхование, 401(k) с компанией-матчем, оплачиваемый отпуск и другие выплаты.
— Гибкий график работы и поддержка баланса работы и личной жизни.
— Процесс верификации личности с использованием биометрии и ИИ для предотвращения мошенничества.
Задачи:
– Создание отказоустойчивых и отказоустойчивых инфраструктур
– Масштабирование инфраструктуры для обработки высоких нагрузок
– Настройка процессов сборки и доставки кода
– Автоматизация и оптимизация рутинных задач
– Внедрение новых инструментов и технологий
– Поддержка и разработка кластеров баз данных
– Управление и устранение неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Участие в дежурствах по вызову
Требования:
– Более 4 лет коммерческого опыта в области DevOps
– Опыт управления серверами и инфраструктурой Linux с использованием инструментов IaC (Ansible, Terraform или аналогичные)
– GitLab CI: настройка конвейеров CI/CD для бесперебойной доставки контейнеров Docker с кодом на Python или Go
– Настройка и обслуживание кластеров баз данных (PostgreSQL, Kafka, Redis, Aerospike, Consul)
– Работа с системами мониторинга и логирования (Zabbix, Prometheus, VictoriaMetrics, Grafana, ELK, Sentry)
– Работа с контейнеризацией: Docker, docker-compose
– Опыт управления и устранения неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Опыт поддержки и разработки кластеров PostgreSQL, понимание принципов высокой доступности, резервного копирования и репликации
– Разговорный английский на уровне B1 или выше (средний уровень)
Задачи:
— Развертывание и поддержка full nodes (Ethereum, Bitcoin, Tron)
— Настройка и сопровождение RPC, архивных и валидаторных нод
— Обеспечение высокой доступности (HA), отказоустойчивости и масштабируемости инфраструктуры
— Мониторинг состояния нод (Prometheus, Grafana)
— Оптимизация производительности (disk I/O, RAM, CPU, network latency)
— Управление обновлениями клиентов и форками сетей
— Настройка резервного копирования и восстановления данных
— Автоматизация процессов
— Работа с облачной инфраструктурой (Hetzner, OVH, AWS, GCP и аналоги)
— Обеспечение безопасности (firewalls, access control, DDoS protection)
— Поддержка внутренних команд (backend, data, product) через RPC/API endpoints
Требования:
— Опыт DevOps/SRE от 3-х лет
— Практический опыт работы с blockchain nodes
— Глубокое понимание Linux (Ubuntu/Debian), networking и системного администрирования
— Опыт работы с Docker, Kubernetes
— Уверенное владение инструментами мониторинга и логирования
— Опыт автоматизации (Bash, Python или Go)
— Понимание принципов консенсуса (PoW, PoS, validators)
— Опыт работы с high-load системами
Будет плюсом:
— Опыт запуска валидаторов и участия в staking
— Работа с MEV, indexers, archive nodes
— Знание специфики L2 решений (Arbitrum, Optimism, zkSync)
— Опыт работы с Web3 API (Infura, Alchemy аналоги)
— Понимание безопасности ключей и HSM решений
Технологический стек:
OS: Linux (Ubuntu)
Containers: Docker, Kubernetes
Infra: Terraform, Ansible
Monitoring: Prometheus, Grafana
Cloud: AWS / GCP / Hetzner
Blockchain clients: Geth, Erigon, Nethermind, Bitcoin Core, Solana Validator
Задачи:
— Работа с Docker и системами оркестрации контейнеров Kubernetes
— Управление конфигурациями с помощью Ansible, ArgoCD и инструментов IaC Terraform
— Построение CI/CD пайплайнов с использованием GitLab CI и Jenkins
— Работа с системами мониторинга и логирования: Prometheus, VictoriaMetrics, Grafana, Loki, ELK
— Администрирование Linux и сетевые взаимодействия в микросервисной архитектуре
— Изучение новых технологий (мультиагентные фреймворки, RAG, MCP) и предложение улучшений
— Понимание жизненного цикла AI-агентов и ML-моделей
— Разработка и развертывание автономных AI-агентов с использованием MCP, RAG
— Работа с платформами для оркестрации агентов и serverless-средами
— Интеграция корпоративных систем (OneWork, SberSpace)
— Интерес к искусственному интеллекту и агентным системам
Условия:
— Работа в стабильной компании с официальным трудоустройством по ТК РФ с первого дня
— "Белая" заработная плата
— Расширенный социальный пакет: ДМС (включая стоматологию), корпоративные скидки на фитнес, спортивные секции
— Профессиональное обучение и развитие
— Современная техника, мощный ноутбук предоставляется в день оформления
— Формат работы: строго офис, Москва
Компания Неватех — продуктовая IT-компания на стеке современных fintech-технологий. Ведущий DevOps-инженер возьмёт ответственность за развитие инфраструктуры, надёжность сервисов и инженерные практики команды. Роль hands-on: проектирование решений, определение технических стандартов, самостоятельная работа с инфраструктурой и production-средой.
Требования:
— Опыт работы в DevOps/SRE от 4 лет
— Уверенное администрирование Linux
— Практический опыт работы с Docker и Kubernetes
— Опыт построения и развития CI/CD-процессов в GitLab
— Опыт управления инфраструктурой как кодом с помощью Terraform и Ansible
— Опыт настройки мониторинга и алертинга в Grafana
— Практический опыт работы с Loki и централизованным сбором логов
— Опыт настройки Sentry и использования его для диагностики ошибок
— Понимание принципов отказоустойчивости, масштабирования и информационной безопасности
— Умение расследовать инциденты, находить первопричины и предотвращать их повторение
— Способность принимать технические решения, формировать стандарты и развивать инженерные практики команды
Будет преимуществом:
— Опыт работы с высоконагруженными или fintech-проектами
— Опыт построения инфраструктуры с высокими требованиями к доступности
— Знание подходов SRE: SLI/SLO, error budget, incident management
— Опыт оптимизации производительности и стоимости инфраструктуры
— Опыт менторинга или технического лидерства
— Знание Python, Go или Bash
Задачи:
— Развивать инфраструктуру production-, stage- и test-среду
— Проектировать надёжную, масштабируемую и безопасную архитектуру
— Развивать Kubernetes-кластеры и контейнерную платформу
— Автоматизировать развёртывание и управление инфраструктурой
— Развивать CI/CD-пайплайны в GitLab, ускорять и стабилизировать доставку изменений
— Развивать систему мониторинга и алертинга в Grafana
— Поддерживать централизованный сбор и анализ логов с использованием Loki
— Развивать мониторинг ошибок приложений в Sentry
— Повышать наблюдаемость сервисов и сокращать время обнаружения и устранения проблем
— Участвовать в расследовании production-инцидентов и проводить разбор их причин
— Повышать отказоустойчивость сервисов и качество процессов эксплуатации
— Формировать DevOps-стандарты и проводить ревью инфраструктурных изменений
— Помогать разработчикам и другим инженерам решать инфраструктурные задачи
— Участвовать в планировании технического развития платформы
Условия:
— Работа в аккредитованной IT-компании (подходит под условия IT-ипотеки)
— Оформление по ТК РФ с "белой" заработной платой
— Работа с сильным продуктом на рынке
— Возможность влиять на технические решения и развитие инфраструктуры
— Офис в центре Санкт-Петербурга с современной техникой, зоной отдыха, SonyPlaystation и теннисным столом
— Гибридный формат работы (3 дня в офисе, 2 дня удалённо)
— ДМС после испытательного срока
Москва
Зарплата не указана
УдалённоmiddleOntario
127 500 – 159 500 $
Удалённоsenior
10 669 – 14 435 $
ГибридleadСанкт-Петербург
Зарплата не указана
Все вакансии в одном месте — страница 4 · Job Hunters