Компания Centicore занимается продуктовой разработкой проектов Заказчиков под ключ. Вакансия Senior DevOps с удалённым форматом работы (РФ) и зарплатой 300 000-400 000 рублей на руки.
Требования:
— Опыт работы от 4-5 лет в эксплуатации высоконагруженных распределённых ИТ-систем.
— Отличные знания Kubernetes.
— Практический опыт настройки сетевых фабрик и Service Mesh (например, Istio, Linkerd).
— Опыт развертывания, оптимизации и масштабирования open-source компонентов Observability: сборщики и CDC (Vector, Debezium, OpenTelemetry Collector).
— Опыт работы с брокерами Apache Kafka (настройка кластеров, тюнинг партиций, управление квотами, обеспечение отказоустойчивости).
— Навыки администрирования, горизонтального масштабирования и резервного копирования баз данных (реляционных и аналитических/временных рядов): VictoriaMetrics, ClickHouse, Elasticsearch.
— Уверенное владение инструментами Infrastructure as Code (Terraform / OpenTofu, Ansible).
— Опыт построения CI/CD пайплайнов (GitLab CI, ArgoCD).
— Уверенное владение Bash/Shell.
— Хорошие навыки автоматизации рутинных задач на Python или Go.
Условия:
— Удалённый формат работы в IT аккредитованной компании.
— Длительный проект.
— Оплачиваемый отпуск 28 календарных дней в год и оплачиваемые больничные.
— Предоставление техники (MAC, Windows).
— ДМС со стоматологией.
— Компенсация хобби/спортзала/английского языка.
— Компенсация профессионального обучения.
— Возможность участия во внутренних программах компании и активностях, например, в реферальной программе «приведи друга».
— Онлайн и оффлайн корпоративные мероприятия (йога, шахматы, покер, квиз, марафон, CS2 и др.).
— Программа лояльности Сентибонусы за проявление активностей, стаж работы и др..
— Оформление по ТК.
Требования:
— 5+ лет опыта
— опыт с высоконагруженными системами
— опыт с Rust
— опыт с Tokio
— опыт с Linux
Позиция в топовую проприетарную трейдинговую компанию
Формат работы: удалённо.
Задачи:
– Полностью контролировать платформу Proxmox и Ceph — управление мощностью, обновлениями, производительностью и реагированием на инциденты.
– Запускать инфраструктуру на платформах OVH, Hetzner и физических серверах, а также рабочие нагрузки в AWS и GCP.
– Оптимизировать ресурсы: выявлять случаи переплаты, определять оптимальные параметры и доказывать экономию на счетах.
– Обеспечивать разделение рабочих нагрузок разработки на выделенный кластер без простоев в производственной среде.
– Всё делать в виде кода — Terraform, Ansible, ArgoCD и GitLab CI, без ручных изменений в продакшене.
– Обеспечивать собственную надежность: дежурство, реагирование на инциденты, анализ первопричин и следование инструкциям по действиям.
– Поддерживать уровень данных, на котором работает продукт — PostgreSQL, ClickHouse, Aerospike.
Требования:
– Более 10 лет опыта работы с инфраструктурой и физическим оборудованием, не только в сфере управляемых облачных решений.
– Более 5 лет опыта работы с Kubernetes и облачными платформами в производственной среде.
– Практический опыт работы с физическими серверами и провайдерами OVH и Hetzner, а также с AWS и/или GCP.
– Уверенное владение Terraform, Ansible, ArgoCD и GitLab CI — инфраструктура описывается в коде.
– Реальный опыт работы в сфере финансовых операций: способность назвать стоимость инфраструктуры до и после изменений.
– Способность доводить проблемы до первопричины и находить пути решения, включая за пределами формальной компетенции.
– Открытость в коммуникации: риски и плохие новости сообщаются на ранних этапах, а не после инцидента.
Удалённоsenior
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Karta.io — это платформа виртуальных банковских и криптовалютных карт, которая позволяет оплачивать покупки по всему миру с помощью стейблкоинов и криптовалюты.
Мы ищем Lead Platform Engineer, который заберёт платформу и инфраструктурную безопасность внутрь команды и доведёт её до продакшн-зрелости.
Требования к кандидату:
- 3+ года опыта в продакшн с AWS и Kubernetes
- Опыт работы с Terraform в продакшн
- Опыт в продуктовой компании с инфраструктурой
- Участие в аудите PCI DSS или SOC 2 Type 2
- Английский на уровне объяснения для не-инженеров
- Знание GitOps (ArgoCD / Flux) будет плюсом
- Опыт эксплуатации Python/Django-приложений
Задачи:
— Проектировать и строить инфраструктурные примитивы, определяющие масштабирование CI/CD платформы, систем сборки и сред разработки по всей инженерной организации.
— Помогать строить и эксплуатировать Kubernetes-контрольную плоскость для CI/CD платформы, включая инфраструктуру self-hosted раннеров GitHub Actions (автомасштабирование, изоляция, оптимизация затрат и производительности), GitHub Apps и GitHub-as-code (права доступа, вебхуки, автоматизация на уровне организации), безопасный сетевой доступ для CI/CD и удалённых сред разработки (Tailscale), GitOps-деплой платформенных сервисов (Flux), эфемерные/по требованию среды разработки и системы сборки.
— Разрабатывать ключевые инфраструктурные компоненты, включая Kubernetes Operators и автомасштабирование, которые напрямую используют продуктовые команды, снижая необходимость в индивидуальных CI/CD и средах.
— Не заниматься операционной поддержкой, а создавать системы, определяющие процесс сборки, тестирования и деплоя, формируя надёжность и масштабируемость опыта разработчиков в организации.
Требования:
— 6–9+ лет опыта в SRE, платформенной или инфраструктурной инженерии.
— Подтверждённый опыт масштабирования Kubernetes в высоконагруженных продуктивных средах.
— Глубокие знания Kubernetes, включая внутренние механизмы, поведение планировщика, кастомные ресурсы и диагностику сбоев на уровне кластера.
— Опыт создания платформенной инфраструктуры, контрольных плоскостей или Kubernetes Operators, а не только их использования.
— Сильный опыт распределённых систем и обеспечения надёжности в продуктиве.
— Владение Terraform и GitOps, включая проектирование и сопровождение автоматизации, а не только выполнение сценариев.
— Опыт работы с GitOps-подходами (Flux, ArgoCD).
— Практический опыт масштабных CI/CD платформ: GitHub Actions (self-hosted раннеры, workflows-as-code), GitHub Apps, системы сборки.
— Опыт работы с AWS и облачной инфраструктурой в продуктиве.
— Владение Go (предпочтительно) или другим системным языком.
Условия:
— Удалённая работа из Канады.
— Зарплата от 90 000 до 125 000 USD в год.
Что нужно делать:
— Осуществлять деплой, обновление и настройку кластеров k8s;
— Администрировать базовые инфраструктурные сервисы: Gitlab, Harbor, Nexus, Trivy, Ansible, Keycloak, s3 minio;
— Заниматься поддержкой системы непрерывной интеграции Gitlab CI;
— Администрировать внутреннюю серверную инфраструктуру компании;
— Осуществлять настройку мониторинга, логирования и бэкапов;
— Курировать написание ролей Ansible;
— Осуществлять базовое администрирование СУБД MySQL, pgSQL, создание кластеров, создание баз, нарезание прав;
— Администрировать балансировщики нагрузки на базе HAproxy, NGINX.
Мы ждём, что ты имеешь:
— Опыт администрирования Linux-систем;
— Опыт администрирования S3 хранилищ;
— Знание принципов IaC, работа с инфраструктурой, как с кодом;
— Опыт работы с Nexus, Harbor на уровне администратора;
— Опыт работы с Gitlab (on-premises) на уровне администратора;
— Опыт подготовки CI/CD обвязки\pipeline;
— Опыт администрирования Kubernetes(on-premises) от 3-х лет;
— Опыт работы с системами автоматизации на базе Ansible, Terraform;
— Опыт работы с балансировщиками нагрузки: HAproxy, nginx.
Будет плюсом:
— Наличие опыта работы с GitOps инструментами;
— Опыт внедрения систем мониторинга серверов и контейнеров;
— Опыт работы с Helm;
— Понимание GitFlow.
О проекте
Japanstat создаёт экосистему, которая соединяет весь рынок японских авто: от аукционов в Японии до дилеров и покупателей в России, ОАЭ, Австралии, Африке, Монголии, на Кипре и ещё в десятках стран.
Это сложный B2B-продукт с высокой нагрузкой, данными в реальном времени и десятками интеграций. Инфраструктура здесь напрямую влияет на бизнес клиентов по всему миру.
Кого мы ищем
Мы ищем DevOps-инженера, который уверенно работает с Linux, Kubernetes и CI/CD и хочет отвечать за стабильность высоконагруженного продукта. Для нас важно, чтобы вы были самостоятельным, мыслили системно и легко находили общий язык с разработчиками и QA.
Что предстоит делать
— Строить и развивать CI/CD-пайплайны
— Управлять облачной и серверной инфраструктурой через Infrastructure as Code
— Развивать среду на Docker/Kubernetes: развертывание и масштабирование сервисов
— Настраивать мониторинг, логирование и алертинг, участвовать в разборе инцидентов
— Автоматизировать процессы и делать релизы стабильными
— Оперативно реагировать на инциденты на проде, в том числе вне рабочего времени
Что для нас важно
— Уверенный Linux, сети, понимание веб-сервисов и микросервисной архитектуры
— Практический опыт с Docker и Kubernetes
— CI/CD: GitLab CI, Jenkins или аналоги
— IaC: Terraform, Ansible или аналоги
— Мониторинг и логирование: Prometheus, Grafana и др.
— Git, Bash, базовые навыки Python/Go/Node.js
— Понимание ИБ, управления секретами и доступами
Будет плюсом
— Опыт с high-load / high-availability системами
— Helm, Argo CD, GitOps
— PostgreSQL, Redis, Kafka/RabbitMQ
— Балансировка нагрузки и CDN
— Практики SRE: SLI/SLO/SLA, incident management, postmortem
— FinOps: оптимизация стоимости и производительности облака
Что мы даём
— Полная удаленка из любой точки мира
— Официальное трудоустройство
— Оклад 240 000 ₽ на руки, возможны премии
— Подарки и бонусы от компании на праздники
— График 5/2, 9:00–18:00 по Москве
— Компенсация за реагирование на инциденты вне рабочего времени
— Без регулярных переработок: вне графика — только экстренные инциденты
Обо мне:
DevOps-инженер с коммерческим опытом сопровождения production-систем, высоконагруженных банковских сервисов и платформы AI-агентов. Специализируюсь на Kubernetes, автоматизации инфраструктуры через Terraform и Ansible, развитии CI/CD, мониторинге и логировании.
Работал с облачными и закрытыми on-premise-контурами. Участвовал в проектировании инфраструктуры, проведении релизов, устранении production-инцидентов и повышении надёжности сервисов.
Ключевые результаты и опыт:
- Спроектировал отказоустойчивую Kubernetes-платформу для production-сервисов обработки текстовых и голосовых обращений.
- Стандартизировал CI/CD для 35+ микросервисов на базе GitLab CI/CD, Helm и Argo CD, сократив среднее время релиза с 35 до 8 минут.
- Автоматизировал развёртывание облачной и on-premise-инфраструктуры через Terraform и Ansible, сократив подготовку клиентского контура с двух рабочих дней до 90 минут.
- Построил observability-платформу на Prometheus, VictoriaMetrics, Grafana, Loki и Alertmanager, сократив среднее время восстановления сервисов с 50 до 18 минут.
- Разработал стратегию резервного копирования PostgreSQL, S3-совместимых хранилищ и Kubernetes-ресурсов с использованием WAL-G и Velero.
- Переработал Jenkins pipelines и Helm-чарты для 50+ банковских сервисов, сократив время типового релиза с 40 до 12 минут.
- Внедрил canary-развёртывания и автоматическую проверку health-метрик после релиза.
- Настроил мониторинг и централизованное логирование для Kubernetes, Kafka, PostgreSQL, Redis и прикладных сервисов.
- Интегрировал HashiCorp Vault с CI/CD и Kubernetes для централизованного управления секретами.
- Участвовал в устранении production-инцидентов, проводил RCA и актуализовал runbook-инструкции.
Образование высшее
Английский язык: B2.
Задачи:
- Планирование и выполнение развертывания инфраструктуры с использованием инструментов автоматизации и лучших практик для обеспечения стабильной и масштабируемой платформы.
- Управление ежедневными операциями, устранение проблем и оптимизация рабочих процессов для поддержания высокой доступности и выполнения целей по уровню сервиса.
- Разработка backend-функций, поддерживающих все платформы (расширение, мобильные и десктопные).
- Взаимодействие с конечными пользователями и разработчиками, поддержка и сбор обратной связи для направления развития продукта.
- Работа с командой по созданию и поддержанию культуры повышения стандартов с каждым новым сотрудником.
- Использование лучших практик AI-инжиниринга для повышения продуктивности разработчиков и скорости разработки — стандартизация AI-поддерживаемых рабочих процессов (кодирование, ревью, отладка, реагирование на инциденты), создание и поддержка внутренних инструментов и подсказок, измерение влияния через метрики доставки и надежности.
Требования:
- Глубокий опыт управления и построения на облачных платформах (AWS, Cloudflare).
- Опыт работы с Kubernetes и смежными технологиями (Istio, Helm Charts).
- Опыт управления конфигурацией инфраструктуры (Terraform, Atlantis).
- Опыт создания CI/CD пайплайнов и ускорения доставки приложений (GitHub Actions, ArgoCD).
- Опыт работы с технологиями наблюдаемости в продакшене (Prometheus, Grafana, Sentry).
- Практический опыт программирования на Go (сети, HTTP, gRPC, OpenTelemetry).
- Экспертиза в реализации принципов SRE с акцентом на поддержание высокой доступности.
- Знакомство с обработкой инцидентов и обязанностями on-call.
- Сильные основы безопасности и практический опыт внедрения лучших практик безопасности в облаке и Kubernetes.
Задачи:
— Обеспечение надежности, масштабируемости и производительности распределенной инфраструктуры ZK-сопроцессоров.
— Управление парком блокчейн-нод (RPC, Validators) и специализированных Prover-нод в мультичейн среде.
— Автоматизация процессов развертывания и управления инфраструктурой (IaC) с использованием Terraform / Pulumi.
— Глубокий мониторинг и алертинг (Prometheus, Grafana, VictoriaMetrics) с фокусом на специфические метрики блокчейна и прувинга.
— Оптимизация производительности систем (Performance Tuning) и работа над минимизацией сетевых задержек (low-latency).
— Управление инцидентами, проведение Post-mortem анализа и разработка мер по предотвращению повторных сбоев.
— Внедрение и развитие практик GitOps и CI/CD пайплайнов для инфраструктурных и прикладных сервисов.
Требования:
— Опыт работы в роли SRE или DevOps Engineer от 4-5 лет.
— Экспертное владение Kubernetes (управление кластерами, написание Helm чартов / Operator SDK).
— Глубокие знания Linux internals, сетевых протоколов и безопасности.
— Опыт работы с облачными провайдерами (AWS — основной, GCP/Azure).
— Уверенное владение Python или Go для написания инструментов автоматизации.
— Практический опыт работы с инструментами IaC (Terraform).
— Английский язык: Upper-Intermediate (свободная коммуникация в международной команде).
Будет плюсом:
— Опыт эксплуатации блокчейн-инфраструктуры (Ethereum, L2s, Solana).
— Понимание специфики работы ZK-Rollups или систем с интенсивными вычислениями (GPU/FPGA acceleration).
— Опыт работы с инструментами распределенной трассировки (Jaeger / Tempo).
Для заказчика Первый Бит ищем специалиста для внедрения методологии DevOps и развития системы, используемой сотнями клиентов по всему миру. Проект высоконагруженный, работает на сотнях серверов, включает монолит и микросервисную архитектуру.
Задачи:
– сопровождение и развитие процесса CI/CD
– настройка мониторинга сервисов
– помощь разработчикам в организации тестовых и рабочих сред
– стандартизация решений и подходов
– участие в проработке архитектурных решений
– взаимодействие с командой разработчиков и ops
Требования:
– опыт построения CI/CD процессов
– опыт работы с дата-центрами
– опыт работы с Gitlab CI, Vault, Docker, Ansible
– опыт работы и сопровождения nginx, балансировщиков
– опыт работы с брокерами сообщений RabbitMq, Kafka
– опыт работы с S3 (minio)
– опыт администрирования Linux
– опыт настройки мониторинга сервисов (Zabbix / Prometheus+Grafana)
– понимание масштабирования и отказоустойчивой инфраструктуры
– понимание работы сетей, широкий технический кругозор
Задачи:
— Развертывание и эксплуатация Bitcoin Core nodes.
— Построение отказоустойчивой инфраструктуры для backend-сервисов.
— Мониторинг состояния Bitcoin-нод и внутренних сервисов.
— Настройка metrics, logging, alerting и dashboards.
— Secrets management и безопасная работа с credentials.
— Backup и disaster recovery.
— Автоматизация deployment и infrastructure provisioning.
— CI/CD.
— Контроль доступов и сегментация инфраструктуры.
— Анализ и устранение production-инцидентов.
— Capacity planning и оптимизация ресурсов.
— Совместная работа с security engineer над hardening инфраструктуры.
Требования:
— Опыт DevOps/SRE в production-системах.
— Linux на уверенном уровне.
— Docker и контейнерная инфраструктура.
— Опыт с Kubernetes или аналогичными orchestration-платформами.
— Infrastructure as Code: Terraform, Ansible или аналоги.
— Опыт построения monitoring/alerting систем.
— Понимание сетей, firewall, TLS и управления доступом.
— Практический опыт secrets management.
— Опыт построения backup/recovery процессов.
— Умение расследовать production-инциденты.
Будет плюсом:
— Опыт эксплуатации Bitcoin Core nodes.
— Понимание Bitcoin P2P/networking.
— Опыт эксплуатации blockchain infrastructure.
— Опыт с security-sensitive или financial infrastructure.
— Опыт защиты публичных сервисов от DDoS/DoS.
— Опыт построения privacy-oriented инфраструктуры.
Что важно в этой роли:
Для проекта критична не только доступность сервисов, но и минимизация инфраструктурных рисков и утечек метаданных. Поэтому нам нужен инженер, который рассматривает security и privacy как часть инфраструктурной архитектуры, а не как отдельный этап после запуска.
Задачи:
— Проектирование, внедрение и поддержка DevOps-инструментов для дата-пайплайнов и платформ.
— Поддержка и автоматизация ETL-воркфлоу (например, Spark, Airflow).
— Создание и управление мониторингом и наблюдаемостью качества данных (DBT), дата-пайплайнов и систем хранения.
— Внедрение и поддержка инфраструктуры хранения данных на AWS (S3, EC2, сеть).
— Интеграция и поддержка Project Nessie как транзакционного каталога для Data Lakes с семантикой, похожей на Git.
— Тесное взаимодействие с Data Engineers для обеспечения плавного деплоя, версионирования и масштабирования дата-задач и пайплайнов.
— Автоматизация деплоя и CI/CD процессов с использованием GitLab CI/CD.
— Обеспечение лучших практик безопасности при работе с чувствительными данными.
— Написание автоматизации инфраструктуры на Python, Bash, Ansible.
— Документирование систем, пайплайнов и DevOps-процессов.
Требования:
— Опыт 5+ лет в DevOps / IT Ops / DataOps с практическим опытом работы с инфраструктурой, связанной с данными.
— Глубокие знания Linux (сеть, настройка ядра, оптимизация производительности).
— Практический опыт работы с Airflow, ClickHouse, DBT, Spark и Project Nessie.
— Солидные знания AWS (S3, EC2, IAM, сеть).
— Владение скриптингом и автоматизацией (Python, Bash, Ansible).
— Опыт работы с CI/CD пайплайнами (GitLab).
— Опыт с мониторинговыми стеками (Prometheus, Grafana, ELK).
— Знакомство с контейнеризацией и оркестрацией (Docker, Kubernetes).
— Понимание концепций управления данными.
— Сильные коммуникативные навыки и проактивный подход.
Желательно:
— Опыт работы с потоковой обработкой данных в реальном времени.
— Знание инфраструктуры как кода (Terraform).
— Знакомство с безопасностью в дата-инжиниринге (IAM, шифрование, контроль доступа).
— Опыт работы с высокопроизводительными системами или в торговой среде.
Nitka Technologies is an international IT company specializing in custom software development and IT consulting.
The vacancy is for a Senior SRE Engineer / Platform Reliability Engineer position with remote work.
No further details about tasks, requirements, or conditions are provided in the text.
Задачи:
– Создание отказоустойчивых и отказоустойчивых инфраструктур
– Масштабирование инфраструктуры для обработки высоких нагрузок
– Настройка процессов сборки и доставки кода
– Автоматизация и оптимизация рутинных задач
– Внедрение новых инструментов и технологий
– Поддержка и разработка кластеров баз данных
– Управление и устранение неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Участие в дежурствах по вызову
Требования:
– Более 4 лет коммерческого опыта в области DevOps
– Опыт управления серверами и инфраструктурой Linux с использованием инструментов IaC (Ansible, Terraform или аналогичные)
– GitLab CI: настройка конвейеров CI/CD для бесперебойной доставки контейнеров Docker с кодом на Python или Go
– Настройка и обслуживание кластеров баз данных (PostgreSQL, Kafka, Redis, Aerospike, Consul)
– Работа с системами мониторинга и логирования (Zabbix, Prometheus, VictoriaMetrics, Grafana, ELK, Sentry)
– Работа с контейнеризацией: Docker, docker-compose
– Опыт управления и устранения неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Опыт поддержки и разработки кластеров PostgreSQL, понимание принципов высокой доступности, резервного копирования и репликации
– Разговорный английский на уровне B1 или выше (средний уровень)
Задачи:
— Установка и администрирование виртуальных машин.
— Развёртывание и сопровождение Kubernetes-кластера.
— Разработка и поддержка CI/CD пайплайнов (GitLab).
— Создание Helm-чартов и Ansible-плейбуков.
— Мониторинг инфраструктуры (Zabbix, Prometheus, Grafana).
— Ведение документации в Wiki.
— Деплой приложений (сервисы, контейнеры).
— Взаимодействие с разработчиками.
— Диагностика и устранение проблем.
— Предупреждение сбоев и обеспечение стабильности сервисов.
Требования:
— Опыт администрирования Linux (Ubuntu) от 3 лет.
— Опыт с Kubernetes (или OpenShift) от 2–3 лет.
— Знание Docker и Helm.
— Опыт с VMware, AWS, GCP.
— Навыки настройки CI/CD (GitLab).
— Владение Git.
— Опыт взаимодействия с разработчиками.
— Знание PostgreSQL, Nginx, RabbitMQ, Zabbix.
— Автоматизация через Ansible и скрипты (bash).
— Анализ логов и работа с ними в Linux.
Условия:
— Работа в команде профессионалов, наставничество.
— Динамичный бизнес с международными проектами.
— Практика и развитие компетенций, индивидуальный план развития.
— Удалённая работа из любой точки мира.
— Официальное оформление по ТК РФ, возможна релокация в Сербию после испытательного срока.
— Конкурентная заработная плата с возможностью роста.
— Стабильная оплата с учётом всех выплат.
— Гибкий график работы.
— ДМС с первого рабочего дня, включая стоматологию.
Задачи:
— настройка и поддержка пайплайнов CI/CD, поддержка релизного процесса;
— масштабирование проекта;
— администрирование инфраструктуры в рамках своего проекта;
— мониторинг и логирование своего проекта;
— взаимодействие с коллегами из девопс-команды и инфраструктуры.
Требования:
— писать и поддерживать пайплайны (GitLab CI);
— работать с Kubernetes и Helm;
— администрировать системы на Linux;
— владеть скриптовыми языками Bash, Python, Go;
— владеть контейнерными технологиями Docker;
— работать с Terraform и Ansible;
— работать с Git;
— работать с базами данных SQL;
— иметь опыт настройки и поддержки систем мониторинга, логирования и визуализации;
— базовые знания сетевых технологий.