Задачи:
— Проектировать и строить инфраструктурные примитивы, определяющие масштабирование CI/CD платформы, систем сборки и сред разработки по всей инженерной организации.
— Помогать строить и эксплуатировать Kubernetes-контрольную плоскость для CI/CD платформы, включая инфраструктуру self-hosted раннеров GitHub Actions (автомасштабирование, изоляция, оптимизация затрат и производительности), GitHub Apps и GitHub-as-code (права доступа, вебхуки, автоматизация на уровне организации), безопасный сетевой доступ для CI/CD и удалённых сред разработки (Tailscale), GitOps-деплой платформенных сервисов (Flux), эфемерные/по требованию среды разработки и системы сборки.
— Разрабатывать ключевые инфраструктурные компоненты, включая Kubernetes Operators и автомасштабирование, которые напрямую используют продуктовые команды, снижая необходимость в индивидуальных CI/CD и средах.
— Не заниматься операционной поддержкой, а создавать системы, определяющие процесс сборки, тестирования и деплоя, формируя надёжность и масштабируемость опыта разработчиков в организации.
Требования:
— 6–9+ лет опыта в SRE, платформенной или инфраструктурной инженерии.
— Подтверждённый опыт масштабирования Kubernetes в высоконагруженных продуктивных средах.
— Глубокие знания Kubernetes, включая внутренние механизмы, поведение планировщика, кастомные ресурсы и диагностику сбоев на уровне кластера.
— Опыт создания платформенной инфраструктуры, контрольных плоскостей или Kubernetes Operators, а не только их использования.
— Сильный опыт распределённых систем и обеспечения надёжности в продуктиве.
— Владение Terraform и GitOps, включая проектирование и сопровождение автоматизации, а не только выполнение сценариев.
— Опыт работы с GitOps-подходами (Flux, ArgoCD).
— Практический опыт масштабных CI/CD платформ: GitHub Actions (self-hosted раннеры, workflows-as-code), GitHub Apps, системы сборки.
— Опыт работы с AWS и облачной инфраструктурой в продуктиве.
— Владение Go (предпочтительно) или другим системным языком.
Условия:
— Удалённая работа из Канады.
— Зарплата от 90 000 до 125 000 USD в год.
Что нужно делать:
— Осуществлять деплой, обновление и настройку кластеров k8s;
— Администрировать базовые инфраструктурные сервисы: Gitlab, Harbor, Nexus, Trivy, Ansible, Keycloak, s3 minio;
— Заниматься поддержкой системы непрерывной интеграции Gitlab CI;
— Администрировать внутреннюю серверную инфраструктуру компании;
— Осуществлять настройку мониторинга, логирования и бэкапов;
— Курировать написание ролей Ansible;
— Осуществлять базовое администрирование СУБД MySQL, pgSQL, создание кластеров, создание баз, нарезание прав;
— Администрировать балансировщики нагрузки на базе HAproxy, NGINX.
Мы ждём, что ты имеешь:
— Опыт администрирования Linux-систем;
— Опыт администрирования S3 хранилищ;
— Знание принципов IaC, работа с инфраструктурой, как с кодом;
— Опыт работы с Nexus, Harbor на уровне администратора;
— Опыт работы с Gitlab (on-premises) на уровне администратора;
— Опыт подготовки CI/CD обвязки\pipeline;
— Опыт администрирования Kubernetes(on-premises) от 3-х лет;
— Опыт работы с системами автоматизации на базе Ansible, Terraform;
— Опыт работы с балансировщиками нагрузки: HAproxy, nginx.
Будет плюсом:
— Наличие опыта работы с GitOps инструментами;
— Опыт внедрения систем мониторинга серверов и контейнеров;
— Опыт работы с Helm;
— Понимание GitFlow.
О проекте
Japanstat создаёт экосистему, которая соединяет весь рынок японских авто: от аукционов в Японии до дилеров и покупателей в России, ОАЭ, Австралии, Африке, Монголии, на Кипре и ещё в десятках стран.
Это сложный B2B-продукт с высокой нагрузкой, данными в реальном времени и десятками интеграций. Инфраструктура здесь напрямую влияет на бизнес клиентов по всему миру.
Кого мы ищем
Мы ищем DevOps-инженера, который уверенно работает с Linux, Kubernetes и CI/CD и хочет отвечать за стабильность высоконагруженного продукта. Для нас важно, чтобы вы были самостоятельным, мыслили системно и легко находили общий язык с разработчиками и QA.
Что предстоит делать
— Строить и развивать CI/CD-пайплайны
— Управлять облачной и серверной инфраструктурой через Infrastructure as Code
— Развивать среду на Docker/Kubernetes: развертывание и масштабирование сервисов
— Настраивать мониторинг, логирование и алертинг, участвовать в разборе инцидентов
— Автоматизировать процессы и делать релизы стабильными
— Оперативно реагировать на инциденты на проде, в том числе вне рабочего времени
Что для нас важно
— Уверенный Linux, сети, понимание веб-сервисов и микросервисной архитектуры
— Практический опыт с Docker и Kubernetes
— CI/CD: GitLab CI, Jenkins или аналоги
— IaC: Terraform, Ansible или аналоги
— Мониторинг и логирование: Prometheus, Grafana и др.
— Git, Bash, базовые навыки Python/Go/Node.js
— Понимание ИБ, управления секретами и доступами
Будет плюсом
— Опыт с high-load / high-availability системами
— Helm, Argo CD, GitOps
— PostgreSQL, Redis, Kafka/RabbitMQ
— Балансировка нагрузки и CDN
— Практики SRE: SLI/SLO/SLA, incident management, postmortem
— FinOps: оптимизация стоимости и производительности облака
Что мы даём
— Полная удаленка из любой точки мира
— Официальное трудоустройство
— Оклад 240 000 ₽ на руки, возможны премии
— Подарки и бонусы от компании на праздники
— График 5/2, 9:00–18:00 по Москве
— Компенсация за реагирование на инциденты вне рабочего времени
— Без регулярных переработок: вне графика — только экстренные инциденты
Удалённо
240 000 – 240 000 ₽
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
— Работа с Asterisk, SIP, VoIP
— Работа с Linux
— Использование ARI и AMI
— Работа с базами данных MariaDB и MySQL
— Настройка SIP провайдеров и маршрутизация звонков
— Обеспечение безопасности VoIP и мониторинг
Требования:
— Опыт работы с Asterisk не менее 2 лет
— Глубокие знания SIP и VoIP
— Хорошие навыки работы с Linux
— Умение самостоятельно устранять проблемы
Обо мне:
DevOps-инженер с коммерческим опытом сопровождения production-систем, высоконагруженных банковских сервисов и платформы AI-агентов. Специализируюсь на Kubernetes, автоматизации инфраструктуры через Terraform и Ansible, развитии CI/CD, мониторинге и логировании.
Работал с облачными и закрытыми on-premise-контурами. Участвовал в проектировании инфраструктуры, проведении релизов, устранении production-инцидентов и повышении надёжности сервисов.
Ключевые результаты и опыт:
- Спроектировал отказоустойчивую Kubernetes-платформу для production-сервисов обработки текстовых и голосовых обращений.
- Стандартизировал CI/CD для 35+ микросервисов на базе GitLab CI/CD, Helm и Argo CD, сократив среднее время релиза с 35 до 8 минут.
- Автоматизировал развёртывание облачной и on-premise-инфраструктуры через Terraform и Ansible, сократив подготовку клиентского контура с двух рабочих дней до 90 минут.
- Построил observability-платформу на Prometheus, VictoriaMetrics, Grafana, Loki и Alertmanager, сократив среднее время восстановления сервисов с 50 до 18 минут.
- Разработал стратегию резервного копирования PostgreSQL, S3-совместимых хранилищ и Kubernetes-ресурсов с использованием WAL-G и Velero.
- Переработал Jenkins pipelines и Helm-чарты для 50+ банковских сервисов, сократив время типового релиза с 40 до 12 минут.
- Внедрил canary-развёртывания и автоматическую проверку health-метрик после релиза.
- Настроил мониторинг и централизованное логирование для Kubernetes, Kafka, PostgreSQL, Redis и прикладных сервисов.
- Интегрировал HashiCorp Vault с CI/CD и Kubernetes для централизованного управления секретами.
- Участвовал в устранении production-инцидентов, проводил RCA и актуализовал runbook-инструкции.
Образование высшее
Английский язык: B2.
Задачи:
- Планирование и выполнение развертывания инфраструктуры с использованием инструментов автоматизации и лучших практик для обеспечения стабильной и масштабируемой платформы.
- Управление ежедневными операциями, устранение проблем и оптимизация рабочих процессов для поддержания высокой доступности и выполнения целей по уровню сервиса.
- Разработка backend-функций, поддерживающих все платформы (расширение, мобильные и десктопные).
- Взаимодействие с конечными пользователями и разработчиками, поддержка и сбор обратной связи для направления развития продукта.
- Работа с командой по созданию и поддержанию культуры повышения стандартов с каждым новым сотрудником.
- Использование лучших практик AI-инжиниринга для повышения продуктивности разработчиков и скорости разработки — стандартизация AI-поддерживаемых рабочих процессов (кодирование, ревью, отладка, реагирование на инциденты), создание и поддержка внутренних инструментов и подсказок, измерение влияния через метрики доставки и надежности.
Требования:
- Глубокий опыт управления и построения на облачных платформах (AWS, Cloudflare).
- Опыт работы с Kubernetes и смежными технологиями (Istio, Helm Charts).
- Опыт управления конфигурацией инфраструктуры (Terraform, Atlantis).
- Опыт создания CI/CD пайплайнов и ускорения доставки приложений (GitHub Actions, ArgoCD).
- Опыт работы с технологиями наблюдаемости в продакшене (Prometheus, Grafana, Sentry).
- Практический опыт программирования на Go (сети, HTTP, gRPC, OpenTelemetry).
- Экспертиза в реализации принципов SRE с акцентом на поддержание высокой доступности.
- Знакомство с обработкой инцидентов и обязанностями on-call.
- Сильные основы безопасности и практический опыт внедрения лучших практик безопасности в облаке и Kubernetes.
Задачи:
— Обеспечение надежности, масштабируемости и производительности распределенной инфраструктуры ZK-сопроцессоров.
— Управление парком блокчейн-нод (RPC, Validators) и специализированных Prover-нод в мультичейн среде.
— Автоматизация процессов развертывания и управления инфраструктурой (IaC) с использованием Terraform / Pulumi.
— Глубокий мониторинг и алертинг (Prometheus, Grafana, VictoriaMetrics) с фокусом на специфические метрики блокчейна и прувинга.
— Оптимизация производительности систем (Performance Tuning) и работа над минимизацией сетевых задержек (low-latency).
— Управление инцидентами, проведение Post-mortem анализа и разработка мер по предотвращению повторных сбоев.
— Внедрение и развитие практик GitOps и CI/CD пайплайнов для инфраструктурных и прикладных сервисов.
Требования:
— Опыт работы в роли SRE или DevOps Engineer от 4-5 лет.
— Экспертное владение Kubernetes (управление кластерами, написание Helm чартов / Operator SDK).
— Глубокие знания Linux internals, сетевых протоколов и безопасности.
— Опыт работы с облачными провайдерами (AWS — основной, GCP/Azure).
— Уверенное владение Python или Go для написания инструментов автоматизации.
— Практический опыт работы с инструментами IaC (Terraform).
— Английский язык: Upper-Intermediate (свободная коммуникация в международной команде).
Будет плюсом:
— Опыт эксплуатации блокчейн-инфраструктуры (Ethereum, L2s, Solana).
— Понимание специфики работы ZK-Rollups или систем с интенсивными вычислениями (GPU/FPGA acceleration).
— Опыт работы с инструментами распределенной трассировки (Jaeger / Tempo).
Мы — Московская Школа Программистов. Уже более 25 лет мы учим детей программированию и помогаем им раскрывать способности в ИТ. Сейчас мы активно растём, и в связи с расширением ищем в нашу команду специалиста удалённой технической поддержки пользователей.
Для заказчика Первый Бит ищем специалиста для внедрения методологии DevOps и развития системы, используемой сотнями клиентов по всему миру. Проект высоконагруженный, работает на сотнях серверов, включает монолит и микросервисную архитектуру.
Задачи:
– сопровождение и развитие процесса CI/CD
– настройка мониторинга сервисов
– помощь разработчикам в организации тестовых и рабочих сред
– стандартизация решений и подходов
– участие в проработке архитектурных решений
– взаимодействие с командой разработчиков и ops
Требования:
– опыт построения CI/CD процессов
– опыт работы с дата-центрами
– опыт работы с Gitlab CI, Vault, Docker, Ansible
– опыт работы и сопровождения nginx, балансировщиков
– опыт работы с брокерами сообщений RabbitMq, Kafka
– опыт работы с S3 (minio)
– опыт администрирования Linux
– опыт настройки мониторинга сервисов (Zabbix / Prometheus+Grafana)
– понимание масштабирования и отказоустойчивой инфраструктуры
– понимание работы сетей, широкий технический кругозор
About the Team
The Security Operations team protects CircleCI’s infrastructure, product, and customer data against evolving threats, working closely with engineering to maintain security and resilience.
About the Role
As a Security Operations Engineer, you will protect CircleCI’s infrastructure, product, and customer data from AI-driven attacks and defenses. This intermediate role involves ownership of security challenges, collaboration with Engineering, contributing to the security roadmap, and leveraging AI tools to detect, respond to, and automate security threats.
What You’ll Do:
Threat Detection & Incident Response
— Monitor, investigate, and respond to security threats across cloud and application environments using security and AI-assisted tools.
— Participate in risk assessments, incident response, post-incident reviews, and on-call support, improving controls and processes.
Security Engineering & Architecture
— Build and maintain security tooling, controls, and automation across cloud, application, and CI/CD environments following best practices.
— Identify vulnerabilities and configuration risks, contribute to runbooks and compliance, and understand CircleCI’s security architecture.
AI & Security
— Incorporate AI-powered security tools into workflows and evaluate emerging technologies for detection, response, and automation.
— Stay current on AI-specific security threats and contribute to responsible AI use in security operations.
Cross-Team Partnership & Ownership
— Partner with Engineering teams to understand security needs, provide guidance, and translate risks into actionable recommendations.
— Contribute to security roadmap planning, technology evaluations, and documentation while building relationships across teams.
What You’ll Bring:
— 3+ years of security engineering or operations experience or equivalent expertise.
— Hands-on experience with cloud, application, and CI/CD security in AWS, GCP, or Azure.
— Experience with incident response and security tools including EDR, CNAPP, SASE, vulnerability scanners, and log analysis.
— Ability to build and maintain security automation and tooling using Go, Python, or Terraform.
— Strong security judgment and problem-solving skills.
— Hands-on experience with AI/ML-powered security tools in production and understanding of AI’s role in security workflows.
Bonus Skills (Nice to Have):
— Familiarity with AI-specific threat categories like prompt injection and model supply chain risks.
— Experience securing developer platforms, SaaS, or CI/CD infrastructure.
— Relevant certifications such as CEH, AWS Security Specialty, Security+.
— Contributions to process improvement, runbook development, or knowledge sharing.
Accommodation
CircleCI provides reasonable accommodation for individuals with disabilities during application and employment.
About CircleCI
CircleCI is the world’s largest CI/CD platform, processing over 3 million jobs daily, helping companies leverage AI in software delivery. Founded in 2011, headquartered in San Francisco with a global remote workforce, and venture-backed by multiple investors.
Equal Opportunity
CircleCI is an Equal Opportunity and Affirmative Action employer, not discriminating based on legally protected characteristics and considering applicants with criminal histories consistent with laws.
Задачи:
— Проектировать, внедрять и управлять решениями и контролями безопасности для AWS и Kubernetes, включая методы изоляции для платформы RCE-as-a-Service.
— Создавать, развёртывать и поддерживать инфраструктуру как код с использованием Terraform, обеспечивая высокие стандарты безопасности.
— Проводить оценки безопасности, моделирование угроз и аудиты AWS и Kubernetes.
— Сотрудничать с командами разработки и эксплуатации для внедрения лучших практик безопасности в CI/CD.
— Мониторить и реагировать на инциденты безопасности в облаке, выявлять причины и рекомендовать меры по устранению.
— Обеспечивать соответствие требованиям комплаенса (SOC 2, ISO 27001, GDPR, HIPAA, PCI DSS).
— Наставлять инженеров и продвигать культуру облачной безопасности в организации.
Требования:
— Опыт работы в облачной безопасности не менее 5 лет, глубокие знания AWS.
— Профессиональные навыки в области безопасности Kubernetes: защита кластеров, RBAC, сетевые политики, управление уязвимостями контейнеров.
— Экспертное владение Terraform.
— Знание сервисов безопасности AWS (IAM, GuardDuty, Security Hub, CloudTrail, WAF).
— Знакомство с CNAPP решениями (Wiz) и SIEM (Panther).
— Понимание безопасного жизненного цикла разработки ПО, безопасности CI/CD и DevSecOps.
— Желательны сертификаты AWS Certified Security – Specialty, Certified Kubernetes Security Specialist (CKS), Terraform Associate.
— Приветствуются сертификаты SANS или OffSec.
— Отличные навыки решения проблем, коммуникации и лидерства.
Условия:
— Удалённая работа из США (SF, NYC или Remote).
— Конкурентная зарплата и пакет вознаграждений, включая акции, медицинские льготы и гибкий отпуск.
Дополнительно:
— Работа в команде инженеров, тесное сотрудничество с командой безопасности.
— Технологический стек включает Typescript, React, Apollo GraphQL, Redux, Express, Postgres, Redis, Kubernetes, Terraform, Helm, AWS.
Задачи:
— Развертывание и эксплуатация Bitcoin Core nodes.
— Построение отказоустойчивой инфраструктуры для backend-сервисов.
— Мониторинг состояния Bitcoin-нод и внутренних сервисов.
— Настройка metrics, logging, alerting и dashboards.
— Secrets management и безопасная работа с credentials.
— Backup и disaster recovery.
— Автоматизация deployment и infrastructure provisioning.
— CI/CD.
— Контроль доступов и сегментация инфраструктуры.
— Анализ и устранение production-инцидентов.
— Capacity planning и оптимизация ресурсов.
— Совместная работа с security engineer над hardening инфраструктуры.
Требования:
— Опыт DevOps/SRE в production-системах.
— Linux на уверенном уровне.
— Docker и контейнерная инфраструктура.
— Опыт с Kubernetes или аналогичными orchestration-платформами.
— Infrastructure as Code: Terraform, Ansible или аналоги.
— Опыт построения monitoring/alerting систем.
— Понимание сетей, firewall, TLS и управления доступом.
— Практический опыт secrets management.
— Опыт построения backup/recovery процессов.
— Умение расследовать production-инциденты.
Будет плюсом:
— Опыт эксплуатации Bitcoin Core nodes.
— Понимание Bitcoin P2P/networking.
— Опыт эксплуатации blockchain infrastructure.
— Опыт с security-sensitive или financial infrastructure.
— Опыт защиты публичных сервисов от DDoS/DoS.
— Опыт построения privacy-oriented инфраструктуры.
Что важно в этой роли:
Для проекта критична не только доступность сервисов, но и минимизация инфраструктурных рисков и утечек метаданных. Поэтому нам нужен инженер, который рассматривает security и privacy как часть инфраструктурной архитектуры, а не как отдельный этап после запуска.
Задачи:
— Построение threat model для CoinJoin-протокола и всей системы.
— Анализ возможных атак на coordinator и участников протокола.
— Проектирование защиты от Sybil-атак и DoS.
— Анализ возможных утечек метаданных.
— Анализ privacy-свойств протокола.
— Аудит механизмов authentication, authorization и rate limiting.
— Анализ key-management архитектуры.
— Security review Bitcoin transaction flow.
— Code review критичных компонентов.
— Анализ attack surface backend и инфраструктуры.
— Подготовка рекомендаций по hardening.
— Участие в security testing и подготовке к внешним аудитам.
Требования:
— Опыт application security, protocol security или security engineering.
— Умение самостоятельно строить threat models.
— Хорошее понимание сетевой безопасности.
— Понимание DoS/DDoS и Sybil attack моделей.
— Опыт security review backend-систем.
— Понимание криптографических примитивов и digital signatures.
— Опыт анализа key-management систем.
— Умение проводить code review с точки зрения безопасности.
— Понимание рисков metadata leakage и privacy-sensitive систем.
Будет большим плюсом:
— Глубокое понимание Bitcoin protocol.
— Опыт security-аудита Bitcoin или других cryptocurrency-протоколов.
— Знание UTXO, PSBT, SegWit, Taproot и Bitcoin transaction signing.
— Опыт анализа CoinJoin или других privacy protocols.
— Понимание blockchain analysis и deanonymization techniques.
— Опыт аудита non-custodial систем.
— Практический опыт Rust/C++/Go.
Что важно в этой роли:
Security engineer должен оценивать не только классические уязвимости backend-приложения, но и экономические, протокольные и privacy-атаки. Для CoinJoin особенно важны поведение злонамеренных участников, Sybil/DoS, корреляция активности и возможные утечки метаданных.
Задачи:
— Проектирование, внедрение и поддержка DevOps-инструментов для дата-пайплайнов и платформ.
— Поддержка и автоматизация ETL-воркфлоу (например, Spark, Airflow).
— Создание и управление мониторингом и наблюдаемостью качества данных (DBT), дата-пайплайнов и систем хранения.
— Внедрение и поддержка инфраструктуры хранения данных на AWS (S3, EC2, сеть).
— Интеграция и поддержка Project Nessie как транзакционного каталога для Data Lakes с семантикой, похожей на Git.
— Тесное взаимодействие с Data Engineers для обеспечения плавного деплоя, версионирования и масштабирования дата-задач и пайплайнов.
— Автоматизация деплоя и CI/CD процессов с использованием GitLab CI/CD.
— Обеспечение лучших практик безопасности при работе с чувствительными данными.
— Написание автоматизации инфраструктуры на Python, Bash, Ansible.
— Документирование систем, пайплайнов и DevOps-процессов.
Требования:
— Опыт 5+ лет в DevOps / IT Ops / DataOps с практическим опытом работы с инфраструктурой, связанной с данными.
— Глубокие знания Linux (сеть, настройка ядра, оптимизация производительности).
— Практический опыт работы с Airflow, ClickHouse, DBT, Spark и Project Nessie.
— Солидные знания AWS (S3, EC2, IAM, сеть).
— Владение скриптингом и автоматизацией (Python, Bash, Ansible).
— Опыт работы с CI/CD пайплайнами (GitLab).
— Опыт с мониторинговыми стеками (Prometheus, Grafana, ELK).
— Знакомство с контейнеризацией и оркестрацией (Docker, Kubernetes).
— Понимание концепций управления данными.
— Сильные коммуникативные навыки и проактивный подход.
Желательно:
— Опыт работы с потоковой обработкой данных в реальном времени.
— Знание инфраструктуры как кода (Terraform).
— Знакомство с безопасностью в дата-инжиниринге (IAM, шифрование, контроль доступа).
— Опыт работы с высокопроизводительными системами или в торговой среде.
Nitka Technologies is an international IT company specializing in custom software development and IT consulting.
The vacancy is for a Senior SRE Engineer / Platform Reliability Engineer position with remote work.
No further details about tasks, requirements, or conditions are provided in the text.
Задачи:
— Вести техническую клиентскую поддержку: диагностика проблем, сбор контекста, приоритизация и сопровождение запросов до полного решения.
— Настроить процессы Customer Support: Service Desk, категории обращений, SLA, маршрутизацию, шаблоны ответов и метрики качества.
— Создавать и поддерживать базу знаний: инструкции, FAQ и сценарии для разных типов пользователей.
— Настраивать low / no-code интеграции и автоматизации: связки почты, мессенджеров, CRM, Service Desk и других инструментов.
— Искать возможности для автоматизации процессов поддержки с помощью AI-инструментов.
— Проводить онбординг новых клиентов и сопровождать их в работе с продуктом.
— Работать с командами продукта и разработки: оформлять bug-репорты, воспроизводить проблемы, собирать обратную связь и улучшать пользовательский опыт.
Требования:
— Опыт работы в Customer Support, Technical Support, Customer Success или смежной роли от 2 лет.
— Опыт работы с Service Desk системами (Omnidesk, Jira Service Management, Intercom или аналогами).
— Понимание процессов поддержки, SLA и ключевых метрик (FRT, TTR, CSAT, FCR).
— Опыт взаимодействия с командой разработки и составления структурированных bug-репортов.
— Умение объяснять технические вопросы простым языком.
— Самостоятельность, высокий уровень ответственности и желание строить процессы практически с нуля.
— Английский язык — от Upper-Intermediate.
— Будет плюсом опыт использования AI-инструментов, а также low / no-code платформ (n8n, Make, Zapier и др.) для автоматизации процессов поддержки.
Условия:
— full-time
— Оформление: ГПХ (после ИС возможен переход на ТК)
— Динамичная среда и быстрые итерации.
— Возможность построить Customer Support практически с нуля и влиять на развитие процессов.
— Высокая автономность и ориентация на результат.
— Взаимодействие с сильной командой инженеров, продуктовых специалистов и экспертов в области медицины.
Задачи:
– Создание отказоустойчивых и отказоустойчивых инфраструктур
– Масштабирование инфраструктуры для обработки высоких нагрузок
– Настройка процессов сборки и доставки кода
– Автоматизация и оптимизация рутинных задач
– Внедрение новых инструментов и технологий
– Поддержка и разработка кластеров баз данных
– Управление и устранение неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Участие в дежурствах по вызову
Требования:
– Более 4 лет коммерческого опыта в области DevOps
– Опыт управления серверами и инфраструктурой Linux с использованием инструментов IaC (Ansible, Terraform или аналогичные)
– GitLab CI: настройка конвейеров CI/CD для бесперебойной доставки контейнеров Docker с кодом на Python или Go
– Настройка и обслуживание кластеров баз данных (PostgreSQL, Kafka, Redis, Aerospike, Consul)
– Работа с системами мониторинга и логирования (Zabbix, Prometheus, VictoriaMetrics, Grafana, ELK, Sentry)
– Работа с контейнеризацией: Docker, docker-compose
– Опыт управления и устранения неполадок в производственных кластерах Kubernetes, написание Helm-диаграмм
– Опыт поддержки и разработки кластеров PostgreSQL, понимание принципов высокой доступности, резервного копирования и репликации
– Разговорный английский на уровне B1 или выше (средний уровень)