Задачи:
— Проектирование, внедрение и поддержка DevOps-инструментов для дата-пайплайнов и платформ.
— Поддержка и автоматизация ETL-воркфлоу (например, Spark, Airflow).
— Создание и управление мониторингом и наблюдаемостью качества данных (DBT), дата-пайплайнов и систем хранения.
— Внедрение и поддержка инфраструктуры хранения данных на AWS (S3, EC2, сеть).
— Интеграция и поддержка Project Nessie как транзакционного каталога для Data Lakes с семантикой, похожей на Git.
— Тесное взаимодействие с Data Engineers для обеспечения плавного деплоя, версионирования и масштабирования дата-задач и пайплайнов.
— Автоматизация деплоя и CI/CD процессов с использованием GitLab CI/CD.
— Обеспечение лучших практик безопасности при работе с чувствительными данными.
— Написание автоматизации инфраструктуры на Python, Bash, Ansible.
— Документирование систем, пайплайнов и DevOps-процессов.
Требования:
— Опыт 5+ лет в DevOps / IT Ops / DataOps с практическим опытом работы с инфраструктурой, связанной с данными.
— Глубокие знания Linux (сеть, настройка ядра, оптимизация производительности).
— Практический опыт работы с Airflow, ClickHouse, DBT, Spark и Project Nessie.
— Солидные знания AWS (S3, EC2, IAM, сеть).
— Владение скриптингом и автоматизацией (Python, Bash, Ansible).
— Опыт работы с CI/CD пайплайнами (GitLab).
— Опыт с мониторинговыми стеками (Prometheus, Grafana, ELK).
— Знакомство с контейнеризацией и оркестрацией (Docker, Kubernetes).
— Понимание концепций управления данными.
— Сильные коммуникативные навыки и проактивный подход.
Желательно:
— Опыт работы с потоковой обработкой данных в реальном времени.
— Знание инфраструктуры как кода (Terraform).
— Знакомство с безопасностью в дата-инжиниринге (IAM, шифрование, контроль доступа).
— Опыт работы с высокопроизводительными системами или в торговой среде.
Nitka Technologies is an international IT company specializing in custom software development and IT consulting.
The vacancy is for a Senior SRE Engineer / Platform Reliability Engineer position with remote work.
No further details about tasks, requirements, or conditions are provided in the text.
Удалённоsenior
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
— проектировать и строить распределённую вычислительную платформу на ~1000 машин;
— развивать инфраструктуру на Kubernetes / Nomad для запуска и управления ML workload'ами;
— работать с GPU-кластерами и вычислительными ресурсами разных типов — GPU, CPU, MPS;
— развивать распределённые вычисления на Ray и инфраструктуру для distributed training;
— автоматизировать размещение и запуск задач, управление ресурсами и их загрузкой;
— заниматься масштабированием, производительностью, отказоустойчивостью, CI/CD и мониторингом;
— тесно работать с ML-командой над инфраструктурой для обучения и запуска нейросетей.
Требования:
— 3–5+ лет опыта в DevOps / MLOps / Platform Engineering;
— уверенный Kubernetes и/или Nomad;
— опыт работы с большими production-кластерами и распределёнными системами;
— практический опыт с GPU-инфраструктурой;
— понимание обучения нейросетей и distributed training;
— опыт с Docker / Docker Registry, CI/CD, Linux, мониторингом;
— опыт проектирования и создания инфраструктуры с нуля;
— будет большим плюсом опыт с HPC, суперкомпьютерами, GPU-фермами, Ray и крупными вычислительными кластерами.
Условия:
— full-time
Задачи:
— проектирование, масштабирование и автоматизация сред (Prod/Stage/Test) через IaC (Terraform, Ansible)
— развитие и поддержка кластеров Kubernetes и Docker
— развитие пайплайнов в GitLab CI/CD для ускорения доставки кода
— развитие мониторинга, логов и алертинга (Grafana, Loki, Sentry)
— расследование production-сбоев, разбор причин, повышение отказоустойчивости
— внедрение DevOps-стандартов, инфраструктурное ревью, помощь разработчикам
Требования:
— опыт от 4 лет в DevOps/SRE, опыт в качестве Team lead
— уверенный Linux, Docker, Kubernetes
— практический опыт с GitLab CI, Terraform и Ansible
— опыт работы со связкой Grafana, Loki, Sentry
— умение расследовать инциденты и выстраивать отказоустойчивую архитектуру
Будет плюсом:
— опыт в Highload / Fintech проектах
— знание практик SRE (SLI/SLO, error budget)
— знание Python, Go или Bash
Условия:
— официальное оформление по ТК РФ, полностью «белая» зарплата
— IT-аккредитация (право на IT-ипотеку и отсрочку)
— ДМС после испытательного срока
— гибридный формат работы (3 дня в офисе, 2 — удалённо)
— возможность собрать команду под себя, влиять на технические решения и развитие инфраструктуры
Задачи:
– Создание отказоустойчивых и отказоустойчивых инфраструктур
– Масштабирование инфраструктуры для обработки высоких нагрузок
– Настройка процессов сборки и доставки кода
– Автоматизация и оптимизация рутинных задач
– Внедрение новых инструментов и технологий
– Поддержка и разработка кластеров баз данных
– Управление и устранение неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Участие в дежурствах по вызову
Требования:
– Более 4 лет коммерческого опыта в области DevOps
– Опыт управления серверами и инфраструктурой Linux с использованием инструментов IaC (Ansible, Terraform или аналогичные)
– GitLab CI: настройка конвейеров CI/CD для бесперебойной доставки контейнеров Docker с кодом на Python или Go
– Настройка и обслуживание кластеров баз данных (PostgreSQL, Kafka, Redis, Aerospike, Consul)
– Работа с системами мониторинга и логирования (Zabbix, Prometheus, VictoriaMetrics, Grafana, ELK, Sentry)
– Работа с контейнеризацией: Docker, docker-compose
– Опыт управления и устранения неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Опыт поддержки и разработки кластеров PostgreSQL, понимание принципов высокой доступности, резервного копирования и репликации
– Разговорный английский на уровне B1 или выше (средний уровень)
Задачи:
— Развертывать и поддерживать Kubernetes
— Развертывать и поддерживать базы данных (PostgreSQL, ClickHouse)
— Разрабатывать пайплайны CI/СD сборки
— Собирать и развертывать приложения у заказчика в «изолированной среде»
— Участвовать в процессах РБПО
— Поддерживать стенды разработки
— Поддерживать системы мониторинга и логирования
— Обеспечивать резервное копирование данных и конфигураций
Требования:
— Опыт Kubernetes: развертывание, управление, мониторинг
— Опыт CI/CD: Gitlab, Jenkins, Helm Charts
— Опыт написания скриптов развертывания приложений и БД на bash и Python
— Опыт внедрения или участия в процессах РБПО
— Опыт работы с отечественными Linux - системами
— Базовые знания SQL
Будет плюсом:
— Опыт PostgreSQL, ClickHouse
— Опыт в продуктах Sber Platform V
Условия:
— Возможность работы в комфортном офисе г. Москва
— Внутренние семинары, внутренние митапы
— Техника для комфортной работы
— ДМС со стоматологией для сотрудников и скидку на покупку ДМС для ближайших членов семьи
— Сессия профессионального развития с планом индивидуального развития и обратной связью
Задачи:
— Установка и администрирование виртуальных машин.
— Развёртывание и сопровождение Kubernetes-кластера.
— Разработка и поддержка CI/CD пайплайнов (GitLab).
— Создание Helm-чартов и Ansible-плейбуков.
— Мониторинг инфраструктуры (Zabbix, Prometheus, Grafana).
— Ведение документации в Wiki.
— Деплой приложений (сервисы, контейнеры).
— Взаимодействие с разработчиками.
— Диагностика и устранение проблем.
— Предупреждение сбоев и обеспечение стабильности сервисов.
Требования:
— Опыт администрирования Linux (Ubuntu) от 3 лет.
— Опыт с Kubernetes (или OpenShift) от 2–3 лет.
— Знание Docker и Helm.
— Опыт с VMware, AWS, GCP.
— Навыки настройки CI/CD (GitLab).
— Владение Git.
— Опыт взаимодействия с разработчиками.
— Знание PostgreSQL, Nginx, RabbitMQ, Zabbix.
— Автоматизация через Ansible и скрипты (bash).
— Анализ логов и работа с ними в Linux.
Условия:
— Работа в команде профессионалов, наставничество.
— Динамичный бизнес с международными проектами.
— Практика и развитие компетенций, индивидуальный план развития.
— Удалённая работа из любой точки мира.
— Официальное оформление по ТК РФ, возможна релокация в Сербию после испытательного срока.
— Конкурентная заработная плата с возможностью роста.
— Стабильная оплата с учётом всех выплат.
— Гибкий график работы.
— ДМС с первого рабочего дня, включая стоматологию.
Задачи:
— Развертывание и поддержка full nodes (Ethereum, Bitcoin, Tron)
— Настройка и сопровождение RPC, архивных и валидаторных нод
— Обеспечение высокой доступности (HA), отказоустойчивости и масштабируемости инфраструктуры
— Мониторинг состояния нод (Prometheus, Grafana)
— Оптимизация производительности (disk I/O, RAM, CPU, network latency)
— Управление обновлениями клиентов и форками сетей
— Настройка резервного копирования и восстановления данных
— Автоматизация процессов
— Работа с облачной инфраструктурой (Hetzner, OVH, AWS, GCP и аналоги)
— Обеспечение безопасности (firewalls, access control, DDoS protection)
— Поддержка внутренних команд (backend, data, product) через RPC/API endpoints
Требования:
— Опыт DevOps/SRE от 3-х лет
— Практический опыт работы с blockchain nodes
— Глубокое понимание Linux (Ubuntu/Debian), networking и системного администрирования
— Опыт работы с Docker, Kubernetes
— Уверенное владение инструментами мониторинга и логирования
— Опыт автоматизации (Bash, Python или Go)
— Понимание принципов консенсуса (PoW, PoS, validators)
— Опыт работы с high-load системами
Будет плюсом:
— Опыт запуска валидаторов и участия в staking
— Работа с MEV, indexers, archive nodes
— Знание специфики L2 решений (Arbitrum, Optimism, zkSync)
— Опыт работы с Web3 API (Infura, Alchemy аналоги)
— Понимание безопасности ключей и HSM решений
Технологический стек:
OS: Linux (Ubuntu)
Containers: Docker, Kubernetes
Infra: Terraform, Ansible
Monitoring: Prometheus, Grafana
Cloud: AWS / GCP / Hetzner
Blockchain clients: Geth, Erigon, Nethermind, Bitcoin Core, Solana Validator
Задачи:
— Работа с Docker и системами оркестрации контейнеров Kubernetes
— Управление конфигурациями с помощью Ansible, ArgoCD и инструментов IaC Terraform
— Построение CI/CD пайплайнов с использованием GitLab CI и Jenkins
— Работа с системами мониторинга и логирования: Prometheus, VictoriaMetrics, Grafana, Loki, ELK
— Администрирование Linux и сетевые взаимодействия в микросервисной архитектуре
— Изучение новых технологий (мультиагентные фреймворки, RAG, MCP) и предложение улучшений
— Понимание жизненного цикла AI-агентов и ML-моделей
— Разработка и развертывание автономных AI-агентов с использованием MCP, RAG
— Работа с платформами для оркестрации агентов и serverless-средами
— Интеграция корпоративных систем (OneWork, SberSpace)
— Интерес к искусственному интеллекту и агентным системам
Условия:
— Работа в стабильной компании с официальным трудоустройством по ТК РФ с первого дня
— "Белая" заработная плата
— Расширенный социальный пакет: ДМС (включая стоматологию), корпоративные скидки на фитнес, спортивные секции
— Профессиональное обучение и развитие
— Современная техника, мощный ноутбук предоставляется в день оформления
— Формат работы: строго офис, Москва
Компания Неватех — продуктовая IT-компания на стеке современных fintech-технологий. Ведущий DevOps-инженер возьмёт ответственность за развитие инфраструктуры, надёжность сервисов и инженерные практики команды. Роль hands-on: проектирование решений, определение технических стандартов, самостоятельная работа с инфраструктурой и production-средой.
Требования:
— Опыт работы в DevOps/SRE от 4 лет
— Уверенное администрирование Linux
— Практический опыт работы с Docker и Kubernetes
— Опыт построения и развития CI/CD-процессов в GitLab
— Опыт управления инфраструктурой как кодом с помощью Terraform и Ansible
— Опыт настройки мониторинга и алертинга в Grafana
— Практический опыт работы с Loki и централизованным сбором логов
— Опыт настройки Sentry и использования его для диагностики ошибок
— Понимание принципов отказоустойчивости, масштабирования и информационной безопасности
— Умение расследовать инциденты, находить первопричины и предотвращать их повторение
— Способность принимать технические решения, формировать стандарты и развивать инженерные практики команды
Будет преимуществом:
— Опыт работы с высоконагруженными или fintech-проектами
— Опыт построения инфраструктуры с высокими требованиями к доступности
— Знание подходов SRE: SLI/SLO, error budget, incident management
— Опыт оптимизации производительности и стоимости инфраструктуры
— Опыт менторинга или технического лидерства
— Знание Python, Go или Bash
Задачи:
— Развивать инфраструктуру production-, stage- и test-среду
— Проектировать надёжную, масштабируемую и безопасную архитектуру
— Развивать Kubernetes-кластеры и контейнерную платформу
— Автоматизировать развёртывание и управление инфраструктурой
— Развивать CI/CD-пайплайны в GitLab, ускорять и стабилизировать доставку изменений
— Развивать систему мониторинга и алертинга в Grafana
— Поддерживать централизованный сбор и анализ логов с использованием Loki
— Развивать мониторинг ошибок приложений в Sentry
— Повышать наблюдаемость сервисов и сокращать время обнаружения и устранения проблем
— Участвовать в расследовании production-инцидентов и проводить разбор их причин
— Повышать отказоустойчивость сервисов и качество процессов эксплуатации
— Формировать DevOps-стандарты и проводить ревью инфраструктурных изменений
— Помогать разработчикам и другим инженерам решать инфраструктурные задачи
— Участвовать в планировании технического развития платформы
Условия:
— Работа в аккредитованной IT-компании (подходит под условия IT-ипотеки)
— Оформление по ТК РФ с "белой" заработной платой
— Работа с сильным продуктом на рынке
— Возможность влиять на технические решения и развитие инфраструктуры
— Офис в центре Санкт-Петербурга с современной техникой, зоной отдыха, SonyPlaystation и теннисным столом
— Гибридный формат работы (3 дня в офисе, 2 дня удалённо)
— ДМС после испытательного срока
Задачи:
— Отвечать за надёжность, производительность и масштабирование production PostgreSQL-кластеров в 24/7 среде
— Влиять на архитектуру и развитие database-инфраструктуры
— Заниматься reliability engineering, performance tuning и автоматизацией
Требования:
— 5+ лет hands-on опыта с PostgreSQL в production
— Глубокое понимание PostgreSQL: WAL, VACUUM/autovacuum, locking, memory management
— Опыт performance tuning: execution plans, индексы, оптимизация запросов, partitioning
— Опыт HA/DR: replication, failover, backup/recovery, Patroni или аналоги
— Опыт работы с Linux + Python для автоматизации
— Опыт работы с high-load / highly available 24/7 системами
— Английский Upper-Intermediate+
Задачи:
— Внедрить культуру SLA/SLO
— Участвовать в инцидентах как архитектор для поиска решений
— Сделать observability по стандарту
— Обеспечить secure-by-default
— Настроить AI-агентов, которые будут автономно собирать контекст по инцидентам, автоматизировать рутину, и создать безопасные контуры для работы с AI
Требования:
— Опыт 5+ лет DevOps/SRE
Условия:
— full-time по ТК РФ
— Помощь релокантам с переездом и первым жильём
— Удобный офис с видом на реку в 5 минутах от м. Речной вокзал
Задачи:
— Внедрить культуру SLA/SLO;
— Участвовать в инцидентах как архитектор для поиска решений;
— Сделать observability по стандарту;
— Обеспечить secure-by-default;
— Настроить AI-агентов, которые будут автономно собирать контекст по инцидентам, автоматизировать рутину, и создать безопасные контуры для работы с AI.
Требования:
— Опыт 5+ лет DevOps/SRE.
Условия:
— Работа в офисе в Новосибирске, удобный офис с видом на реку в 5 минутах от м. Речной вокзал;
— Помощь релокантам с переездом и первым жильём;
— Заработная плата от 450к до 700к net по ТК РФ.
О компании
FANzino — B2B-провайдер игр нового формата в мире онлайн-гемблинга.
Задачи:
— Проектирование, внедрение и поддержка CI/CD пайплайнов с использованием GitLab CI/CD.
— Развертывание, администрирование и масштабирование приложений в Kubernetes (K8s).
— Управление доступами и развертывание систем Jira, Confluence.
— Управление и оптимизация инфраструктуры на базе AWS (EC2, S3, RDS, VPC, IAM, EKS и др.).
— Управление DNS.
— Администрирование и глубокое понимание операционных систем Linux.
— Настройка, мониторинг и обеспечение отказоустойчивости кластеров Kafka и NATS.
— Управление и поддержка кластеров баз данных (PostgreSQL, MySQL, Clickhouse) включая репликацию, бэкапирование и восстановление.
— Внедрение и поддержка систем мониторинга, логирования и оповещения (Prometheus, Grafana, ELK Stack).
— Внедрение и проектирование PKI и SSH инфраструктуры управления доступами.
— Обеспечение безопасности инфраструктуры и приложений.
— Менторство и передача знаний младшим членам команды.
— Поиск и устранение неисправностей, оптимизация производительности систем.
Требования:
— Опыт работы на позиции DevOps Engineer от 5 лет.
— Экспертные знания Kubernetes: опыт развертывания, управления, масштабирования и траблшутинга кластеров.
— Понимание архитектуры K8s.
— Глубокие знания Linux: администрирование, сетями, файловыми системами.
— Опыт работы с GitLab CI/CD: создание и поддержка сложных пайплайнов, интеграция с различными инструментами.
— Практический опыт с Apache Kafka: установка, настройка, мониторинг, оптимизация производительности и обеспечение отказоустойчивости кластеров.
— Уверенный опыт работы с AWS: проектирование и управление инфраструктурой, знание основных сервисов (EC2, S3, RDS, VPC, IAM, Route 53, CloudWatch, EKS).
— Опыт администрирования кластеров баз данных: знание принципов репликации, резервного копирования, восстановления, мониторинга производительности.
— Опыт работы с системами управления конфигурациями Ansible и инструментами Infrastructure as Code - Terraform.
— Работа с предоставлением доступов через SSH, PKI.
— Опыт работы с системами мониторинга и логирования (Prometheus, Grafana, ELK Stack, Zabbix).
— Понимание принципов сетевой безопасности и опыт применения лучших практик.
Будет плюсом:
— Наличие сертификаций AWS (например, AWS Certified DevOps Engineer - Professional).
— Сертификации Kubernetes (CKA, CKAD).
— Опыт работы с другими облачными провайдерами (Azure, GCP).
— Знание других брокеров сообщений (RabbitMQ, Redis Streams).
— Опыт работы с сервис-мешами (Istio, Linkerd).
Личные качества:
— Сильные аналитические и навыки решения проблем.
— Отличные коммуникативные навыки.
— Умение работать в команде и самостоятельно.
— Проактивность и желание развиваться в новых технологиях.
— Ответственность и внимание к деталям.
Условия:
— Работа из офиса: офис на Кипре (Лимассол).
— Гибкое начало рабочего дня.
— Компенсация питания в офисе.
— Официальное оформление по ТК Кипра.
— 4 дополнительных day off.
— Отсутствие легаси.
Задачи:
• Проектирование, масштабирование и автоматизация инфраструктуры сред Prod/Stage/Test через IaC (Terraform, Ansible);
• Развитие и поддержка кластеров Kubernetes и Docker;
• Развитие пайплайнов в GitLab CI/CD для ускорения доставки кода;
• Развитие мониторинга, логов и алертинга с использованием Grafana, Loki, Sentry;
• Расследование production-сбоев, разбор причин, повышение отказоустойчивости;
• Внедрение DevOps-стандартов, инфраструктурное ревью, помощь разработчикам.
Требования:
• Опыт от 4 лет в роли DevOps / SRE;
• Уверенные знания Linux, Docker, Kubernetes;
• Практический опыт с GitLab CI, Terraform и Ansible;
• Опыт работы с мониторингом Grafana, Loki, Sentry;
• Умение расследовать инциденты и выстраивать отказоустойчивую архитектуру.
Будет плюсом:
• Опыт в Highload / Fintech проектах;
• Знание практик SRE (SLI/SLO, error budget);
• Знание Python, Go или Bash;
• Опыт менторинга или техлидства.
Условия:
• Официальное оформление по ТК РФ, полностью «белая» зарплата;
• Наличие IT-аккредитации (IT-ипотека, отсрочка);
• ДМС после завершения испытательного срока;
• Возможность напрямую влиять на технические решения и развитие инфраструктуры.
Задачи:
— настройка и поддержка пайплайнов CI/CD, поддержка релизного процесса;
— масштабирование проекта;
— администрирование инфраструктуры в рамках своего проекта;
— мониторинг и логирование своего проекта;
— взаимодействие с коллегами из девопс-команды и инфраструктуры.
Требования:
— писать и поддерживать пайплайны (GitLab CI);
— работать с Kubernetes и Helm;
— администрировать системы на Linux;
— владеть скриптовыми языками Bash, Python, Go;
— владеть контейнерными технологиями Docker;
— работать с Terraform и Ansible;
— работать с Git;
— работать с базами данных SQL;
— иметь опыт настройки и поддержки систем мониторинга, логирования и визуализации;
— базовые знания сетевых технологий.
Два трека на выбор:
— DevOps с фокусом на базы данных (PostgreSQL, Kafka, Redis, Aerospike, Consul)
— DevOps с фокусом на CI/CD и Kubernetes
Что нужно:
— 4+ года в DevOps
— Linux + IaC (Ansible / Terraform)
— GitLab CI: доставка Docker-контейнеров с Python / Go
— Прод-Kubernetes, Helm-чарты
— Мониторинг: Prometheus, VictoriaMetrics, Grafana, ELK, Sentry
— Английский B1+
Условия:
— удалёнка
— гибкий график
— корпоративная школа английского
— компенсация конференций
— дополнительный выходной MyTime
Зарплата в долларах обсуждается индивидуально по итогам собеседования.