Требования:
— уверенные знания операционных систем семейства Linux;
— опыт знакомства с реляционными СУБД и понимание принципов репликации данных;
— понимание концепции CI/CD;
— понимание процессов разработки;
— концепции IaC (Infrastructure as Code);
— базовое понимание cloud провайдеров (преимущества/возможности);
— базовое понимание NETWORK;
— понимание контейнеризации приложений;
— законченное высшее или среднее специальное профильное образование.
Условия стажировки:
— начальная зарплата после выхода на коммерческий проект от 70 000 RUB (сумма указана до вычета НДФЛ);
— обучение 4 месяца 5 дней в неделю с 9:00 до 18:00 с перерывом на обед;
— изучение теории с еженедельными проверками изученного материала;
— практика на учебных проектах под руководством опытного технического руководителя;
— подготовка к собеседованию и самопрезентации;
— кандидаты из городов, где нет офиса, могут пройти обучение удаленно.
Если знаний недостаточно:
— бесплатное онлайн-обучение "DevOps-инженер" длительностью 1 месяц;
— формат смешанный: самостоятельное изучение материалов на корпоративной платформе + 1 раз в неделю вечернее занятие с преподавателем;
— требования к кандидатам на обучение: законченное высшее или среднее специальное профильное образование, готовность пройти стажировку в компании ASTON.
Что предлагают:
— гарантированный финансовый бонус при старте на коммерческом проекте;
— доступ к корпоративной программе обучения;
— поддержку опытного наставника во время стажировки и после выхода на проект;
— регулярный пересмотр и повышение зарплаты после выхода на проект;
— официальное трудоустройство;
— классические IT-плюшки: офис в центре города, корпоративные мероприятия, частичная компенсация стоимости спортивных абонементов.
Задачи:
— Мониторинг и поддержка систем: постоянное отслеживание состояния инфраструктуры, системных журналов, логов, системных метрик для своевременного выявления потенциальных проблем.
— Диагностика и устранение неисправностей: быстрое выявление сбоев, причин инцидентов и их устранение, проведение анализа инцидентов и подготовка отчетов.
— Управление релизами и обновлениями: планирование, постановка, тестирование и внедрение релизов, обновлений программного обеспечения системы в безопасной среде, минимизация времени простоя.
— Инцидент-менеджмент: быстрое реагирование на кибер- и технические угрозы, инциденты безопасности, взаимодействие с командой информационной безопасности для предотвращения возможных атак.
— Обеспечение безопасности: поддержка конфигураций систем в соответствии с требованиями безопасности, соблюдение стандартов и политик безопасности.
— Ведение документации: создание и актуализация технической документации, журналов, процедур по эксплуатации системы.
Требования:
— Опыт работы инженером по эксплуатации информационных систем от 2 лет, приветствуется опыт в области критической информационной инфраструктуры (КИИ).
— Опыт работы с криптографическими системами, криптоконтейнерами.
— Практический опыт диагностики, устранения инцидентов, анализа логов и работы с автоматизированными системами мониторинга.
— Глубокое понимание архитектуры информационных систем, сетевых протоколов, стандартов безопасности.
— Опыт работы с системами контроля версий (Git) и автоматизации процессов (скрипты).
— Навыки постановки и проведения релизов — подготовка, тестирование, внедрение.
— Развитое аналитическое мышление, умение быстро реагировать на проблемы.
Дополнительные навыки (будет плюсом):
— Знание стандартов безопасности (ISO/IEC 27001, IEC 62443).
— Опыт работы с системами SIEM, системами мониторинга (Prometheus, Zabbix).
— Знание стандартных средств автоматизации (скрипты PowerShell, Bash, Python).
— Навыки работы с системами виртуализации и контейнеризации (Docker, Kubernetes).
— Понимание работы HSM будет плюсом.
Условия:
— Опыт работы в аккредитованной IT-компании над социально значимыми уникальными проектами.
— Официальное трудоустройство с первого рабочего дня.
— Гибридный формат работы в г.Москва, БЦ Академик, Проспект Вернадского д.41 (3 дня офис, 2 дня удалённо).
— Стабильный доход и квартальные премии.
— Компенсацию 9 видов расходов: от КАСКО до путевок на отдых.
— Интересную программу внутреннего и внешнего обучения.
— Сильную команду талантливых специалистов.
— Прозрачные условия для развития и карьерного роста.
— ДМС со стоматологией и международной страховкой.
Обо мне:
DevOps-инженер с коммерческим опытом сопровождения production-систем, высоконагруженных банковских сервисов и платформы AI-агентов. Специализируюсь на Kubernetes, автоматизации инфраструктуры через Terraform и Ansible, развитии CI/CD, мониторинге и логировании.
Работал с облачными и закрытыми on-premise-контурами. Участвовал в проектировании инфраструктуры, проведении релизов, устранении production-инцидентов и повышении надёжности сервисов.
Ключевые результаты и опыт:
- Спроектировал отказоустойчивую Kubernetes-платформу для production-сервисов обработки текстовых и голосовых обращений.
- Стандартизировал CI/CD для 35+ микросервисов на базе GitLab CI/CD, Helm и Argo CD, сократив среднее время релиза с 35 до 8 минут.
- Автоматизировал развёртывание облачной и on-premise-инфраструктуры через Terraform и Ansible, сократив подготовку клиентского контура с двух рабочих дней до 90 минут.
- Построил observability-платформу на Prometheus, VictoriaMetrics, Grafana, Loki и Alertmanager, сократив среднее время восстановления сервисов с 50 до 18 минут.
- Разработал стратегию резервного копирования PostgreSQL, S3-совместимых хранилищ и Kubernetes-ресурсов с использованием WAL-G и Velero.
- Переработал Jenkins pipelines и Helm-чарты для 50+ банковских сервисов, сократив время типового релиза с 40 до 12 минут.
- Внедрил canary-развёртывания и автоматическую проверку health-метрик после релиза.
- Настроил мониторинг и централизованное логирование для Kubernetes, Kafka, PostgreSQL, Redis и прикладных сервисов.
- Интегрировал HashiCorp Vault с CI/CD и Kubernetes для централизованного управления секретами.
- Участвовал в устранении production-инцидентов, проводил RCA и актуализовал runbook-инструкции.
Образование высшее
Английский язык: B2.
УдалённоmiddleМосква
150 000 – 240 000 ₽
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
- Планирование и выполнение развертывания инфраструктуры с использованием инструментов автоматизации и лучших практик для обеспечения стабильной и масштабируемой платформы.
- Управление ежедневными операциями, устранение проблем и оптимизация рабочих процессов для поддержания высокой доступности и выполнения целей по уровню сервиса.
- Разработка backend-функций, поддерживающих все платформы (расширение, мобильные и десктопные).
- Взаимодействие с конечными пользователями и разработчиками, поддержка и сбор обратной связи для направления развития продукта.
- Работа с командой по созданию и поддержанию культуры повышения стандартов с каждым новым сотрудником.
- Использование лучших практик AI-инжиниринга для повышения продуктивности разработчиков и скорости разработки — стандартизация AI-поддерживаемых рабочих процессов (кодирование, ревью, отладка, реагирование на инциденты), создание и поддержка внутренних инструментов и подсказок, измерение влияния через метрики доставки и надежности.
Требования:
- Глубокий опыт управления и построения на облачных платформах (AWS, Cloudflare).
- Опыт работы с Kubernetes и смежными технологиями (Istio, Helm Charts).
- Опыт управления конфигурацией инфраструктуры (Terraform, Atlantis).
- Опыт создания CI/CD пайплайнов и ускорения доставки приложений (GitHub Actions, ArgoCD).
- Опыт работы с технологиями наблюдаемости в продакшене (Prometheus, Grafana, Sentry).
- Практический опыт программирования на Go (сети, HTTP, gRPC, OpenTelemetry).
- Экспертиза в реализации принципов SRE с акцентом на поддержание высокой доступности.
- Знакомство с обработкой инцидентов и обязанностями on-call.
- Сильные основы безопасности и практический опыт внедрения лучших практик безопасности в облаке и Kubernetes.
Задачи:
— Обеспечение надежности, масштабируемости и производительности распределенной инфраструктуры ZK-сопроцессоров.
— Управление парком блокчейн-нод (RPC, Validators) и специализированных Prover-нод в мультичейн среде.
— Автоматизация процессов развертывания и управления инфраструктурой (IaC) с использованием Terraform / Pulumi.
— Глубокий мониторинг и алертинг (Prometheus, Grafana, VictoriaMetrics) с фокусом на специфические метрики блокчейна и прувинга.
— Оптимизация производительности систем (Performance Tuning) и работа над минимизацией сетевых задержек (low-latency).
— Управление инцидентами, проведение Post-mortem анализа и разработка мер по предотвращению повторных сбоев.
— Внедрение и развитие практик GitOps и CI/CD пайплайнов для инфраструктурных и прикладных сервисов.
Требования:
— Опыт работы в роли SRE или DevOps Engineer от 4-5 лет.
— Экспертное владение Kubernetes (управление кластерами, написание Helm чартов / Operator SDK).
— Глубокие знания Linux internals, сетевых протоколов и безопасности.
— Опыт работы с облачными провайдерами (AWS — основной, GCP/Azure).
— Уверенное владение Python или Go для написания инструментов автоматизации.
— Практический опыт работы с инструментами IaC (Terraform).
— Английский язык: Upper-Intermediate (свободная коммуникация в международной команде).
Будет плюсом:
— Опыт эксплуатации блокчейн-инфраструктуры (Ethereum, L2s, Solana).
— Понимание специфики работы ZK-Rollups или систем с интенсивными вычислениями (GPU/FPGA acceleration).
— Опыт работы с инструментами распределенной трассировки (Jaeger / Tempo).
Для заказчика Первый Бит ищем специалиста для внедрения методологии DevOps и развития системы, используемой сотнями клиентов по всему миру. Проект высоконагруженный, работает на сотнях серверов, включает монолит и микросервисную архитектуру.
Задачи:
– сопровождение и развитие процесса CI/CD
– настройка мониторинга сервисов
– помощь разработчикам в организации тестовых и рабочих сред
– стандартизация решений и подходов
– участие в проработке архитектурных решений
– взаимодействие с командой разработчиков и ops
Требования:
– опыт построения CI/CD процессов
– опыт работы с дата-центрами
– опыт работы с Gitlab CI, Vault, Docker, Ansible
– опыт работы и сопровождения nginx, балансировщиков
– опыт работы с брокерами сообщений RabbitMq, Kafka
– опыт работы с S3 (minio)
– опыт администрирования Linux
– опыт настройки мониторинга сервисов (Zabbix / Prometheus+Grafana)
– понимание масштабирования и отказоустойчивой инфраструктуры
– понимание работы сетей, широкий технический кругозор
Задачи:
— Развертывание и эксплуатация Bitcoin Core nodes.
— Построение отказоустойчивой инфраструктуры для backend-сервисов.
— Мониторинг состояния Bitcoin-нод и внутренних сервисов.
— Настройка metrics, logging, alerting и dashboards.
— Secrets management и безопасная работа с credentials.
— Backup и disaster recovery.
— Автоматизация deployment и infrastructure provisioning.
— CI/CD.
— Контроль доступов и сегментация инфраструктуры.
— Анализ и устранение production-инцидентов.
— Capacity planning и оптимизация ресурсов.
— Совместная работа с security engineer над hardening инфраструктуры.
Требования:
— Опыт DevOps/SRE в production-системах.
— Linux на уверенном уровне.
— Docker и контейнерная инфраструктура.
— Опыт с Kubernetes или аналогичными orchestration-платформами.
— Infrastructure as Code: Terraform, Ansible или аналоги.
— Опыт построения monitoring/alerting систем.
— Понимание сетей, firewall, TLS и управления доступом.
— Практический опыт secrets management.
— Опыт построения backup/recovery процессов.
— Умение расследовать production-инциденты.
Будет плюсом:
— Опыт эксплуатации Bitcoin Core nodes.
— Понимание Bitcoin P2P/networking.
— Опыт эксплуатации blockchain infrastructure.
— Опыт с security-sensitive или financial infrastructure.
— Опыт защиты публичных сервисов от DDoS/DoS.
— Опыт построения privacy-oriented инфраструктуры.
Что важно в этой роли:
Для проекта критична не только доступность сервисов, но и минимизация инфраструктурных рисков и утечек метаданных. Поэтому нам нужен инженер, который рассматривает security и privacy как часть инфраструктурной архитектуры, а не как отдельный этап после запуска.
Задачи:
— Проектирование, внедрение и поддержка DevOps-инструментов для дата-пайплайнов и платформ.
— Поддержка и автоматизация ETL-воркфлоу (например, Spark, Airflow).
— Создание и управление мониторингом и наблюдаемостью качества данных (DBT), дата-пайплайнов и систем хранения.
— Внедрение и поддержка инфраструктуры хранения данных на AWS (S3, EC2, сеть).
— Интеграция и поддержка Project Nessie как транзакционного каталога для Data Lakes с семантикой, похожей на Git.
— Тесное взаимодействие с Data Engineers для обеспечения плавного деплоя, версионирования и масштабирования дата-задач и пайплайнов.
— Автоматизация деплоя и CI/CD процессов с использованием GitLab CI/CD.
— Обеспечение лучших практик безопасности при работе с чувствительными данными.
— Написание автоматизации инфраструктуры на Python, Bash, Ansible.
— Документирование систем, пайплайнов и DevOps-процессов.
Требования:
— Опыт 5+ лет в DevOps / IT Ops / DataOps с практическим опытом работы с инфраструктурой, связанной с данными.
— Глубокие знания Linux (сеть, настройка ядра, оптимизация производительности).
— Практический опыт работы с Airflow, ClickHouse, DBT, Spark и Project Nessie.
— Солидные знания AWS (S3, EC2, IAM, сеть).
— Владение скриптингом и автоматизацией (Python, Bash, Ansible).
— Опыт работы с CI/CD пайплайнами (GitLab).
— Опыт с мониторинговыми стеками (Prometheus, Grafana, ELK).
— Знакомство с контейнеризацией и оркестрацией (Docker, Kubernetes).
— Понимание концепций управления данными.
— Сильные коммуникативные навыки и проактивный подход.
Желательно:
— Опыт работы с потоковой обработкой данных в реальном времени.
— Знание инфраструктуры как кода (Terraform).
— Знакомство с безопасностью в дата-инжиниринге (IAM, шифрование, контроль доступа).
— Опыт работы с высокопроизводительными системами или в торговой среде.
Nitka Technologies is an international IT company specializing in custom software development and IT consulting.
The vacancy is for a Senior SRE Engineer / Platform Reliability Engineer position with remote work.
No further details about tasks, requirements, or conditions are provided in the text.
Задачи:
— проектировать и строить распределённую вычислительную платформу на ~1000 машин;
— развивать инфраструктуру на Kubernetes / Nomad для запуска и управления ML workload'ами;
— работать с GPU-кластерами и вычислительными ресурсами разных типов — GPU, CPU, MPS;
— развивать распределённые вычисления на Ray и инфраструктуру для distributed training;
— автоматизировать размещение и запуск задач, управление ресурсами и их загрузкой;
— заниматься масштабированием, производительностью, отказоустойчивостью, CI/CD и мониторингом;
— тесно работать с ML-командой над инфраструктурой для обучения и запуска нейросетей.
Требования:
— 3–5+ лет опыта в DevOps / MLOps / Platform Engineering;
— уверенный Kubernetes и/или Nomad;
— опыт работы с большими production-кластерами и распределёнными системами;
— практический опыт с GPU-инфраструктурой;
— понимание обучения нейросетей и distributed training;
— опыт с Docker / Docker Registry, CI/CD, Linux, мониторингом;
— опыт проектирования и создания инфраструктуры с нуля;
— будет большим плюсом опыт с HPC, суперкомпьютерами, GPU-фермами, Ray и крупными вычислительными кластерами.
Условия:
— full-time
Задачи:
— проектирование, масштабирование и автоматизация сред (Prod/Stage/Test) через IaC (Terraform, Ansible)
— развитие и поддержка кластеров Kubernetes и Docker
— развитие пайплайнов в GitLab CI/CD для ускорения доставки кода
— развитие мониторинга, логов и алертинга (Grafana, Loki, Sentry)
— расследование production-сбоев, разбор причин, повышение отказоустойчивости
— внедрение DevOps-стандартов, инфраструктурное ревью, помощь разработчикам
Требования:
— опыт от 4 лет в DevOps/SRE, опыт в качестве Team lead
— уверенный Linux, Docker, Kubernetes
— практический опыт с GitLab CI, Terraform и Ansible
— опыт работы со связкой Grafana, Loki, Sentry
— умение расследовать инциденты и выстраивать отказоустойчивую архитектуру
Будет плюсом:
— опыт в Highload / Fintech проектах
— знание практик SRE (SLI/SLO, error budget)
— знание Python, Go или Bash
Условия:
— официальное оформление по ТК РФ, полностью «белая» зарплата
— IT-аккредитация (право на IT-ипотеку и отсрочку)
— ДМС после испытательного срока
— гибридный формат работы (3 дня в офисе, 2 — удалённо)
— возможность собрать команду под себя, влиять на технические решения и развитие инфраструктуры
Задачи:
– Создание отказоустойчивых и отказоустойчивых инфраструктур
– Масштабирование инфраструктуры для обработки высоких нагрузок
– Настройка процессов сборки и доставки кода
– Автоматизация и оптимизация рутинных задач
– Внедрение новых инструментов и технологий
– Поддержка и разработка кластеров баз данных
– Управление и устранение неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Участие в дежурствах по вызову
Требования:
– Более 4 лет коммерческого опыта в области DevOps
– Опыт управления серверами и инфраструктурой Linux с использованием инструментов IaC (Ansible, Terraform или аналогичные)
– GitLab CI: настройка конвейеров CI/CD для бесперебойной доставки контейнеров Docker с кодом на Python или Go
– Настройка и обслуживание кластеров баз данных (PostgreSQL, Kafka, Redis, Aerospike, Consul)
– Работа с системами мониторинга и логирования (Zabbix, Prometheus, VictoriaMetrics, Grafana, ELK, Sentry)
– Работа с контейнеризацией: Docker, docker-compose
– Опыт управления и устранения неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Опыт поддержки и разработки кластеров PostgreSQL, понимание принципов высокой доступности, резервного копирования и репликации
– Разговорный английский на уровне B1 или выше (средний уровень)
Задачи:
— Развертывать и поддерживать Kubernetes
— Развертывать и поддерживать базы данных (PostgreSQL, ClickHouse)
— Разрабатывать пайплайны CI/СD сборки
— Собирать и развертывать приложения у заказчика в «изолированной среде»
— Участвовать в процессах РБПО
— Поддерживать стенды разработки
— Поддерживать системы мониторинга и логирования
— Обеспечивать резервное копирование данных и конфигураций
Требования:
— Опыт Kubernetes: развертывание, управление, мониторинг
— Опыт CI/CD: Gitlab, Jenkins, Helm Charts
— Опыт написания скриптов развертывания приложений и БД на bash и Python
— Опыт внедрения или участия в процессах РБПО
— Опыт работы с отечественными Linux - системами
— Базовые знания SQL
Будет плюсом:
— Опыт PostgreSQL, ClickHouse
— Опыт в продуктах Sber Platform V
Условия:
— Возможность работы в комфортном офисе г. Москва
— Внутренние семинары, внутренние митапы
— Техника для комфортной работы
— ДМС со стоматологией для сотрудников и скидку на покупку ДМС для ближайших членов семьи
— Сессия профессионального развития с планом индивидуального развития и обратной связью
Задачи:
— Установка и администрирование виртуальных машин.
— Развёртывание и сопровождение Kubernetes-кластера.
— Разработка и поддержка CI/CD пайплайнов (GitLab).
— Создание Helm-чартов и Ansible-плейбуков.
— Мониторинг инфраструктуры (Zabbix, Prometheus, Grafana).
— Ведение документации в Wiki.
— Деплой приложений (сервисы, контейнеры).
— Взаимодействие с разработчиками.
— Диагностика и устранение проблем.
— Предупреждение сбоев и обеспечение стабильности сервисов.
Требования:
— Опыт администрирования Linux (Ubuntu) от 3 лет.
— Опыт с Kubernetes (или OpenShift) от 2–3 лет.
— Знание Docker и Helm.
— Опыт с VMware, AWS, GCP.
— Навыки настройки CI/CD (GitLab).
— Владение Git.
— Опыт взаимодействия с разработчиками.
— Знание PostgreSQL, Nginx, RabbitMQ, Zabbix.
— Автоматизация через Ansible и скрипты (bash).
— Анализ логов и работа с ними в Linux.
Условия:
— Работа в команде профессионалов, наставничество.
— Динамичный бизнес с международными проектами.
— Практика и развитие компетенций, индивидуальный план развития.
— Удалённая работа из любой точки мира.
— Официальное оформление по ТК РФ, возможна релокация в Сербию после испытательного срока.
— Конкурентная заработная плата с возможностью роста.
— Стабильная оплата с учётом всех выплат.
— Гибкий график работы.
— ДМС с первого рабочего дня, включая стоматологию.
Задачи:
— Развертывание и поддержка full nodes (Ethereum, Bitcoin, Tron)
— Настройка и сопровождение RPC, архивных и валидаторных нод
— Обеспечение высокой доступности (HA), отказоустойчивости и масштабируемости инфраструктуры
— Мониторинг состояния нод (Prometheus, Grafana)
— Оптимизация производительности (disk I/O, RAM, CPU, network latency)
— Управление обновлениями клиентов и форками сетей
— Настройка резервного копирования и восстановления данных
— Автоматизация процессов
— Работа с облачной инфраструктурой (Hetzner, OVH, AWS, GCP и аналоги)
— Обеспечение безопасности (firewalls, access control, DDoS protection)
— Поддержка внутренних команд (backend, data, product) через RPC/API endpoints
Требования:
— Опыт DevOps/SRE от 3-х лет
— Практический опыт работы с blockchain nodes
— Глубокое понимание Linux (Ubuntu/Debian), networking и системного администрирования
— Опыт работы с Docker, Kubernetes
— Уверенное владение инструментами мониторинга и логирования
— Опыт автоматизации (Bash, Python или Go)
— Понимание принципов консенсуса (PoW, PoS, validators)
— Опыт работы с high-load системами
Будет плюсом:
— Опыт запуска валидаторов и участия в staking
— Работа с MEV, indexers, archive nodes
— Знание специфики L2 решений (Arbitrum, Optimism, zkSync)
— Опыт работы с Web3 API (Infura, Alchemy аналоги)
— Понимание безопасности ключей и HSM решений
Технологический стек:
OS: Linux (Ubuntu)
Containers: Docker, Kubernetes
Infra: Terraform, Ansible
Monitoring: Prometheus, Grafana
Cloud: AWS / GCP / Hetzner
Blockchain clients: Geth, Erigon, Nethermind, Bitcoin Core, Solana Validator
Задачи:
— Работа с Docker и системами оркестрации контейнеров Kubernetes
— Управление конфигурациями с помощью Ansible, ArgoCD и инструментов IaC Terraform
— Построение CI/CD пайплайнов с использованием GitLab CI и Jenkins
— Работа с системами мониторинга и логирования: Prometheus, VictoriaMetrics, Grafana, Loki, ELK
— Администрирование Linux и сетевые взаимодействия в микросервисной архитектуре
— Изучение новых технологий (мультиагентные фреймворки, RAG, MCP) и предложение улучшений
— Понимание жизненного цикла AI-агентов и ML-моделей
— Разработка и развертывание автономных AI-агентов с использованием MCP, RAG
— Работа с платформами для оркестрации агентов и serverless-средами
— Интеграция корпоративных систем (OneWork, SberSpace)
— Интерес к искусственному интеллекту и агентным системам
Условия:
— Работа в стабильной компании с официальным трудоустройством по ТК РФ с первого дня
— "Белая" заработная плата
— Расширенный социальный пакет: ДМС (включая стоматологию), корпоративные скидки на фитнес, спортивные секции
— Профессиональное обучение и развитие
— Современная техника, мощный ноутбук предоставляется в день оформления
— Формат работы: строго офис, Москва