Задачи:
— совершенствование существующей инфраструктуры для повышения отказоустойчивости, безопасности и масштабируемости
— усовершенствование системы мониторинга и управления инцидентами с внедрением практик SRE, включая глубокую настройку сетевого мониторинга
— самостоятельное управление облачными и локальными ресурсами с использованием контейнеризации и оркестрации (Docker, Kubernetes)
— автоматизация и поддержка процессов CI/CD (GitLab, TeamCity)
— написание скриптов автоматизации на Bash, применение n8n
— администрирование, установка и настройка Linux (CentOS, Ubuntu)
— создание и поддержка документации по DevOps-процессам и инфраструктуре, включая сетевую схему и политики
— обеспечение сетевой безопасности и сегментации (фаерволы, VPN, анализ сетевой активности)
— участие в экстренном восстановлении сервисов при сбоях (24/7 до "оживления сервиса")
Требования:
Обязательные:
— минимум 5 лет опыта на позиции DevOps Engineer
— навыки администрирования, установки и настройки Linux
— опыт написания скриптов на Bash
— опыт работы с CI/CD инструментами (GitLab CI, TeamCity, Jenkins или аналоги)
— опыт управления облачными и локальными ресурсами с использованием контейнеризации и оркестрации (Docker, Kubernetes не в облаке)
— опыт работы с Nginx
— знания систем автоматизации конфигурации (Terraform, Ansible) и мониторинга (Prometheus, Grafana, OpenSearch)
— опыт работы с S3 Minio, VMware
— понимание основ работы с базами данных (PostgreSQL + Patroni)
— понимание сетевых технологий (сегментация, фаерволы, VPN, маршрутизация, анализ трафика)
— опыт построения геораспределенных и отказоустойчивых кластеров баз данных и Kubernetes (не в облаке)
— умение выявлять проблемы при подключении к VPN и работать с подключённым VPN
— стрессоустойчивость и способность быстро анализировать сложные проблемы в условиях ограниченного времени
Желательные:
— опыт работы в платежных системах с балансом пользователя
— написание скриптов shell, bash, powershell, perl
— опыт работы как сетевой инженер, SRE, инженер внедрения ПАК
— знание Ethernet, TCP/IP, VLAN, модели OSI
— понимание виртуализации QEMU
— сертификаты по информационной безопасности или облачным технологиям
— опыт наставничества или управленческий опыт
Условия:
— работа в офисе в Москве (м. Добрынинская / Серпуховская), удалённой работы нет
— возможен переезд в Белград, Сербия
— график 5/2, 8 часов, начало с 9 до 11, полный день в офисе
— участие в оперативных дежурствах при авариях (компенсируется отгулами), реагирование только на критичные инциденты (1-4 раза в месяц)
— ежемесячный доход выше рынка, обсуждается по итогам интервью
— оплата больничного 14 дней и отпуска 28 дней в размере 100%
— бесплатная парковка у офиса
— релокационный пакет в Москву для специалистов из других городов
— ежегодный пересмотр оплаты на основе рынка
— рабочий ноутбук
— договор на ИП (оплата на р/с)
Обо мне:
DevOps-инженер с коммерческим опытом сопровождения production-систем, высоконагруженных банковских сервисов и платформы AI-агентов. Специализируюсь на Kubernetes, автоматизации инфраструктуры через Terraform и Ansible, развитии CI/CD, мониторинге и логировании.
Работал с облачными и закрытыми on-premise-контурами. Участвовал в проектировании инфраструктуры, проведении релизов, устранении production-инцидентов и повышении надёжности сервисов.
Ключевые результаты и опыт:
- Спроектировал отказоустойчивую Kubernetes-платформу для production-сервисов обработки текстовых и голосовых обращений.
- Стандартизировал CI/CD для 35+ микросервисов на базе GitLab CI/CD, Helm и Argo CD, сократив среднее время релиза с 35 до 8 минут.
- Автоматизировал развёртывание облачной и on-premise-инфраструктуры через Terraform и Ansible, сократив подготовку клиентского контура с двух рабочих дней до 90 минут.
- Построил observability-платформу на Prometheus, VictoriaMetrics, Grafana, Loki и Alertmanager, сократив среднее время восстановления сервисов с 50 до 18 минут.
- Разработал стратегию резервного копирования PostgreSQL, S3-совместимых хранилищ и Kubernetes-ресурсов с использованием WAL-G и Velero.
- Переработал Jenkins pipelines и Helm-чарты для 50+ банковских сервисов, сократив время типового релиза с 40 до 12 минут.
- Внедрил canary-развёртывания и автоматическую проверку health-метрик после релиза.
- Настроил мониторинг и централизованное логирование для Kubernetes, Kafka, PostgreSQL, Redis и прикладных сервисов.
- Интегрировал HashiCorp Vault с CI/CD и Kubernetes для централизованного управления секретами.
- Участвовал в устранении production-инцидентов, проводил RCA и актуализовал runbook-инструкции.
Образование высшее
Английский язык: B2.
Для заказчика Первый Бит ищем специалиста для внедрения методологии DevOps и развития системы, используемой сотнями клиентов по всему миру. Проект высоконагруженный, работает на сотнях серверов, включает монолит и микросервисную архитектуру.
Задачи:
– сопровождение и развитие процесса CI/CD
– настройка мониторинга сервисов
– помощь разработчикам в организации тестовых и рабочих сред
– стандартизация решений и подходов
– участие в проработке архитектурных решений
– взаимодействие с командой разработчиков и ops
Требования:
– опыт построения CI/CD процессов
– опыт работы с дата-центрами
– опыт работы с Gitlab CI, Vault, Docker, Ansible
– опыт работы и сопровождения nginx, балансировщиков
– опыт работы с брокерами сообщений RabbitMq, Kafka
– опыт работы с S3 (minio)
– опыт администрирования Linux
– опыт настройки мониторинга сервисов (Zabbix / Prometheus+Grafana)
– понимание масштабирования и отказоустойчивой инфраструктуры
– понимание работы сетей, широкий технический кругозор
Удалённоsenior
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
— Разработка и поддержка full-stack приложений с использованием Laravel, React и Next.js.
— Интеграция AI-решений с использованием LLM и FastAPI.
— Настройка и поддержка DevOps процессов, включая CI/CD, Docker и автоматизацию релизов.
— Управление пользовательским контентом и файлами через S3 хранилище MinIO с использованием Laravel Spatie Media Library.
— Организация безопасного хранения и выгрузки данных из Postgres, Surreal и S3 с шифрованием.
— Реализация полнотекстового поиска с защитой данных.
Требования:
— Опыт работы 7 лет в full-stack разработке, DevOps и AI-интеграциях.
— Уверенное владение Laravel, React, Next.js, FastAPI.
— Опыт работы с базами данных PostgreSQL и Surreal.
— Навыки настройки CI/CD, Docker, работы с S3 и MinIO.
— Знание методов шифрования данных и безопасности.
Условия:
— Возможность работы full-time, part-time или по B2B.
— Удалённый формат работы.
— Зарплата от $2500 в месяц на руки (примерно $15 в час), обсуждаемо.
Дополнительно:
— Резюме доступно по ссылке: https://docs.google.com/document/d/1681p8QLtPeoIzDwnPKgVVHfL51F2Y1CsS_l73OQchBE/
— Контакт для связи: Telegram @ekangash
— Примеры проектов и портфолио доступны на https://unstock.net и GitHub/GitLab.
Задачи:
— Проектирование, внедрение и поддержка DevOps-инструментов для дата-пайплайнов и платформ.
— Поддержка и автоматизация ETL-воркфлоу (например, Spark, Airflow).
— Создание и управление мониторингом и наблюдаемостью качества данных (DBT), дата-пайплайнов и систем хранения.
— Внедрение и поддержка инфраструктуры хранения данных на AWS (S3, EC2, сеть).
— Интеграция и поддержка Project Nessie как транзакционного каталога для Data Lakes с семантикой, похожей на Git.
— Тесное взаимодействие с Data Engineers для обеспечения плавного деплоя, версионирования и масштабирования дата-задач и пайплайнов.
— Автоматизация деплоя и CI/CD процессов с использованием GitLab CI/CD.
— Обеспечение лучших практик безопасности при работе с чувствительными данными.
— Написание автоматизации инфраструктуры на Python, Bash, Ansible.
— Документирование систем, пайплайнов и DevOps-процессов.
Требования:
— Опыт 5+ лет в DevOps / IT Ops / DataOps с практическим опытом работы с инфраструктурой, связанной с данными.
— Глубокие знания Linux (сеть, настройка ядра, оптимизация производительности).
— Практический опыт работы с Airflow, ClickHouse, DBT, Spark и Project Nessie.
— Солидные знания AWS (S3, EC2, IAM, сеть).
— Владение скриптингом и автоматизацией (Python, Bash, Ansible).
— Опыт работы с CI/CD пайплайнами (GitLab).
— Опыт с мониторинговыми стеками (Prometheus, Grafana, ELK).
— Знакомство с контейнеризацией и оркестрацией (Docker, Kubernetes).
— Понимание концепций управления данными.
— Сильные коммуникативные навыки и проактивный подход.
Желательно:
— Опыт работы с потоковой обработкой данных в реальном времени.
— Знание инфраструктуры как кода (Terraform).
— Знакомство с безопасностью в дата-инжиниринге (IAM, шифрование, контроль доступа).
— Опыт работы с высокопроизводительными системами или в торговой среде.
Задачи:
— Администрирование, конфигурация, оптимизация и поддержка платформы Databricks.
— Управление рабочими пространствами Databricks в средах разработки, тестирования и продакшена.
— Конфигурация и управление кластерами, пулами, заданиями и рабочими процессами для поддержки ETL, потоковых и ML задач.
— Мониторинг состояния платформы, емкости и производительности, проактивное выявление и устранение проблем.
— Управление версиями Databricks runtime, библиотеками и интеграциями с облачным хранилищем и сервисами данных.
— Реализация и поддержка процедур резервного копирования, восстановления и обеспечения непрерывности бизнеса.
— Настройка и поддержка управления идентификацией и доступом (IAM) в Databricks.
— Внедрение и соблюдение лучших практик безопасности, включая шифрование, сетевой контроль и политики доступа к данным.
— Сотрудничество с командами безопасности и соответствия для соблюдения организационных и нормативных требований.
— Поддержка стандартов управления данными (например, Unity Catalog).
— Оптимизация конфигураций кластеров, автоскейлинга и планирования заданий для баланса производительности и затрат.
— Анализ метрик использования и затрат, внедрение стратегий контроля затрат.
— Рекомендации и реализация стратегий настройки и оптимизации платформы для больших данных.
— Взаимодействие с инженерами данных, аналитиками и дата-сайентистами для понимания требований и рекомендаций по использованию Databricks.
— Предоставление поддержки уровня Tier 2/3 по инцидентам и запросам, связанным с Databricks.
— Разработка и поддержка документации, инструкций и стандартных операционных процедур.
— Проведение обучения пользователей и обмен знаниями по возможностям и лучшим практикам Databricks.
— Автоматизация развертывания рабочих пространств и кластеров, конфигураций и политик с использованием Infrastructure as Code (Terraform, ARM/Bicep, CloudFormation).
— Интеграция Databricks с CI/CD пайплайнами для развертывания кода и управления средами.
— Поддержка лучших практик контроля версий для ноутбуков, заданий и конфигураций.
Требования:
— Высшее образование в области компьютерных наук, информационных систем, инженерии или смежных областях либо дополнительный опыт работы 4 года при отсутствии диплома.
— Опыт работы не менее 8 лет в администрировании облачных платформ данных или сред больших данных.
— Практический опыт администрирования Databricks (Azure, AWS или GCP Databricks).
— Глубокое понимание рабочих пространств, кластеров, заданий, пулов и ноутбуков Databricks.
— Знание облачных хранилищ (Azure Data Lake Storage, S3, GCS) и сетевых концепций.
— Опыт управления идентификацией и доступом в соответствующем облачном провайдере (Azure AD, IAM и др.).
— Навыки скриптинга и автоматизации (Python, PowerShell, Bash).
— Знакомство с концепциями Spark (кластеры, исполнители, задания, партиции) и вопросами производительности.
— Опыт мониторинга и устранения проблем с производительностью и надежностью платформы.
— Сильные аналитические и проблемно-ориентированные навыки.
— Умение объяснять сложные технические концепции технической и нетехнической аудитории.
— Ориентация на клиента и качество сервиса.
— Способность работать самостоятельно и в команде в динамичной agile-среде.
Желательные квалификации:
— Сертификация Databricks (например, Databricks Certified Data Engineer Associate/Professional, Lakehouse Fundamentals, Administrator).
— Опыт работы с Unity Catalog и тонкой настройкой доступа к данным.
— Опыт работы с CI/CD инструментами (Azure DevOps, GitHub Actions, Jenkins).
— Опыт работы с Infrastructure as Code (предпочтительно Terraform).
— Опыт работы с инструментами агрегации логов и мониторинга (Azure Monitor, CloudWatch, Datadog, Splunk).
— Знание Delta Lake, структурированного стриминга и архитектур Lakehouse.
— Опыт работы в корпоративных средах с высокими требованиями к безопасности и соответствию.
Условия:
— Удаленная работа из любой точки.
— Полная занятость, 40 часов в неделю.
— Требуется получение и поддержание уровня безопасности Public Trust с обязательной процедурой снятия отпечатков пальцев.
— Требования к резидентству в США: проживание в США или территориях последние 5 лет с ограничениями на время отсутствия.
— Конкурентная зарплата в диапазоне $10,669 – $14,435 в месяц ($128,039 - $173,229 в год), зависит от опыта и местоположения.
— Пакет социальных льгот, включая медицинское страхование, 401(k) с компанией-матчем, оплачиваемый отпуск и другие выплаты.
— Гибкий график работы и поддержка баланса работы и личной жизни.
— Процесс верификации личности с использованием биометрии и ИИ для предотвращения мошенничества.
Задачи:
– Разработка и рефакторинг ETL/ELT пайплайнов на pyspark;
– Разработка и поддержка OLAP движков Starrocks/Clickhouse;
– Поддержка текущих пайплайнов на Greenplum и Hadoop;
– Миграция с HDFS на S3;
– Оптимизация spark-приложений.
Требования:
– Опыт работы с Python от 3 лет;
– Глубокое знание SQL и опыт работы с большими данными;
– Опыт работы с Apache Airflow;
– Опыт проектирования и разработки ETL/ELT процессов;
– Опыт работы с колоночными БД (ClickHouse);
– Знание принципов построения Data Warehouse и Data Lake;
– Понимание разницы между OLTP/OLAP системами;
– Уверенная работа c linux и git;
– Понимание процессов ci/cd.
О компании
FANzino — B2B-провайдер игр нового формата в мире онлайн-гемблинга.
Задачи:
— Проектирование, внедрение и поддержка CI/CD пайплайнов с использованием GitLab CI/CD.
— Развертывание, администрирование и масштабирование приложений в Kubernetes (K8s).
— Управление доступами и развертывание систем Jira, Confluence.
— Управление и оптимизация инфраструктуры на базе AWS (EC2, S3, RDS, VPC, IAM, EKS и др.).
— Управление DNS.
— Администрирование и глубокое понимание операционных систем Linux.
— Настройка, мониторинг и обеспечение отказоустойчивости кластеров Kafka и NATS.
— Управление и поддержка кластеров баз данных (PostgreSQL, MySQL, Clickhouse) включая репликацию, бэкапирование и восстановление.
— Внедрение и поддержка систем мониторинга, логирования и оповещения (Prometheus, Grafana, ELK Stack).
— Внедрение и проектирование PKI и SSH инфраструктуры управления доступами.
— Обеспечение безопасности инфраструктуры и приложений.
— Менторство и передача знаний младшим членам команды.
— Поиск и устранение неисправностей, оптимизация производительности систем.
Требования:
— Опыт работы на позиции DevOps Engineer от 5 лет.
— Экспертные знания Kubernetes: опыт развертывания, управления, масштабирования и траблшутинга кластеров.
— Понимание архитектуры K8s.
— Глубокие знания Linux: администрирование, сетями, файловыми системами.
— Опыт работы с GitLab CI/CD: создание и поддержка сложных пайплайнов, интеграция с различными инструментами.
— Практический опыт с Apache Kafka: установка, настройка, мониторинг, оптимизация производительности и обеспечение отказоустойчивости кластеров.
— Уверенный опыт работы с AWS: проектирование и управление инфраструктурой, знание основных сервисов (EC2, S3, RDS, VPC, IAM, Route 53, CloudWatch, EKS).
— Опыт администрирования кластеров баз данных: знание принципов репликации, резервного копирования, восстановления, мониторинга производительности.
— Опыт работы с системами управления конфигурациями Ansible и инструментами Infrastructure as Code - Terraform.
— Работа с предоставлением доступов через SSH, PKI.
— Опыт работы с системами мониторинга и логирования (Prometheus, Grafana, ELK Stack, Zabbix).
— Понимание принципов сетевой безопасности и опыт применения лучших практик.
Будет плюсом:
— Наличие сертификаций AWS (например, AWS Certified DevOps Engineer - Professional).
— Сертификации Kubernetes (CKA, CKAD).
— Опыт работы с другими облачными провайдерами (Azure, GCP).
— Знание других брокеров сообщений (RabbitMQ, Redis Streams).
— Опыт работы с сервис-мешами (Istio, Linkerd).
Личные качества:
— Сильные аналитические и навыки решения проблем.
— Отличные коммуникативные навыки.
— Умение работать в команде и самостоятельно.
— Проактивность и желание развиваться в новых технологиях.
— Ответственность и внимание к деталям.
Условия:
— Работа из офиса: офис на Кипре (Лимассол).
— Гибкое начало рабочего дня.
— Компенсация питания в офисе.
— Официальное оформление по ТК Кипра.
— 4 дополнительных day off.
— Отсутствие легаси.
Задачи:
– Разрабатывать и проектировать backend-сервисы на Python / FastAPI.
– Проектировать и поддерживать REST API для мобильного приложения, PWA, риск-профиля и ИИ-помощника.
– Описывать и поддерживать контракты API: request/response schemas, validation, error model, versioning.
– Работать с Pydantic, PostgreSQL, Redis и, при необходимости, S3-compatible storage.
– Интегрироваться с AI/ML-слоем: n8n-прототипы, FastAPI/FastMCP-сервисы, LLM API, RAG/context, Qdrant, traces.
– Строить observability: structured logs, trace/request id, metrics, dashboards, error tracking.
– Писать поддерживаемый код, покрывать критичную логику тестами, участвовать в code review и технических обсуждениях.
Требования:
– Опыт backend-разработки на Python от 3 лет.
– Хорошая база в технологиях веба: HTTP, контейнеры, хранение, веб-серверы.
– Практический опыт разработки production API на FastAPI, Django, Flask или аналогичном backend-фреймворке; FastAPI будет сильным плюсом.
– Уверенное владение Python.
– Здравый смысл в использовании ИИ-агентов.
– Хорошее понимание PostgreSQL: схемы, связи, индексы, транзакции, миграции, профилирование запросов.
– Опыт проектирования REST API и умение договариваться о контрактах с mobile/frontend/SA/QA.
– Опыт работы с микросервисами.
– Умение писать тесты для критичной backend-логики.
– Готовность работать в продуктовой команде, где требования меняются быстро, а API влияет на mobile, PWA и AI-сценарии.
Задачи:
— Поддержка, развитие и улучшение облачной инфраструктуры в AWS (включая VPC, EC2, EKS, IAM, Route 53, S3);
— Управление платформами на базе Kubernetes;
— Проектирование, внедрение и поддержка Infrastructure as Code с использованием Terraform и Ansible;
— Поддержка деплоя сервисов и стандартизации платформы с помощью Helm;
— Построение, поддержка и развитие CI/CD‑пайплайнов с использованием GitLab CI и Argo CD, администрирование on‑premises GitLab;
— Поддержка и развитие мониторинга и observability (VictoriaMetrics, VictoriaLogs, Grafana);
— Администрирование и поддержка HashiCorp Vault;
— Диагностика и поддержка Linux‑окружений, работающих на EC2 и в Kubernetes;
— Базовая операционная поддержка PostgreSQL, MS SQL, Apache Airflow, а также БД, работающих в AWS RDS и Kubernetes;
— Участие во внедрении мер безопасности инфраструктуры и платформ (шифрование, сегментация сети, безопасное взаимодействие сервисов и т. д.);
— Разработка внутренних инструментов и решений для автоматизации;
— Разбор инцидентов, выявление первопричин и внедрение превентивных улучшений.
Требования:
— Высшее образование;
— Сильный практический опыт работы с AWS, особенно VPC, EC2, EKS, IAM, Route 53, а также понимание сетевых концепций;
— Уверенный опыт использования Terraform в продакшене;
— Глубокий практический опыт работы с Kubernetes;
— Хорошие знания Helm и опыт поддержки переиспользуемых шаблонов и chart’ов;
— Практический опыт с Helm Library Charts и Go‑templating;
— Уверенные навыки администрирования Linux;
— Хорошее понимание сетевых основ: TCP/IP, DNS, HTTP(S), TLS, VPN, балансировка нагрузки, ingress;
— Опыт построения и поддержки CI/CD‑пайплайнов, предпочтительно с GitLab CI;
— Опыт работы с GitOps‑инструментами, такими как Argo CD;
— Понимание мониторинга, логирования и устранения проблем в распределённых системах;
— Умение писать скрипты и инструменты автоматизации на Bash, Python или Go;
— Понимание основ безопасности инфраструктуры: работа с секретами, шифрование, контроль сетевого доступа, принцип наименьших привилегий, безопасные соединения;
— Английский язык на уровне минимум B1, предстоит общение с иностранцами.
Условия:
— Прозрачную систему мотивации (оклад + ежегодные бонусы до 3ех окладов);
— Подключение на крупный и стабильный проект. Разнообразие интересных задач;
— Отсутствие бюрократии, высокая степень свободы. Решения принимаются очень быстро;
— Карьерный рост, прямое влияние на бизнес и возможность использовать новейшие технологии.
Задачи:
— Администрировать продуктивные и тестовые кластеры ClickHouse, контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц;
— Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой;
— Анализировать системные таблицы ClickHouse и состояние кластера;
— Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц;
— Планировать горизонтальное масштабирование ClickHouse-кластера;
— Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера;
— Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище;
— Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям;
— Настраивать и сопровождать ClickHouse Keeper / ZooKeeper;
— Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия;
— Разрабатывать и проверять backup/restore и disaster recovery;
— Настраивать мониторинг, алерты и дашборды по ClickHouse;
— Готовить Ansible playbooks / roles, runbook’и, инструкции, чек-листы и технические отчёты.
— Администрировать продуктивные и тестовые инсталляции MariaDB;
— Контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов;
— Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication;
— Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах;
— Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster;
— Настраивать, сопровождать и диагностировать Galera Cluster;
— Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски;
— Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий;
— Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO;
— Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети;
— Настраивать TLS/SSL для клиентских подключений и репликации;
— Настраивать мониторинг, алерты, дашборды и runbook’и по MariaDB.
— Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой;
— Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации;
— Формулировать технические гипотезы, проверять их и отделять первопричину от сопутствующих факторов;
— Готовить технические выводы по итогам инцидентов и участвовать в postmortem-разборах;
— Разворачивать тестовые стенды ClickHouse и MariaDB для проверки архитектурных решений;
— Проверять обновления, изменение топологии, расширение хранилища, storage policy и параметры ClickHouse / MariaDB до применения в production;
— Автоматизировать типовые операции через Ansible / Bash / Python / Terraform или аналогичные инструменты;
— Взаимодействовать с заказчиками, объяснять технические риски понятным языком, предлагать решения и лидировать технические обсуждения.
Требования:
— Практический опыт промышленной эксплуатации ClickHouse;
— Понимание архитектуры ClickHouse: shards, replicas, Distributed tables, ReplicatedMergeTree, MergeTree family;
— Опыт диагностики replication queue, merges, mutations, insert/select latency, деградации запросов и проблем с дисковой подсистемой;
— Понимание партиционирования, ключей сортировки, TTL, storage policies, disks, volumes, data skipping indexes;
— Опыт изменения топологии ClickHouse-кластера или глубокое понимание порядка и рисков таких изменений;
— Опыт настройки TLS/SSL для ClickHouse;
— Опыт эксплуатации MariaDB в продуктивной или близкой к продуктивной среде;
— Понимание MariaDB, InnoDB, транзакций, индексов, блокировок, deadlocks, isolation levels;
— Опыт настройки и диагностики репликации MariaDB;
— Понимание GTID, binary logs, relay logs, replication lag, failover и рисков master-master-репликации;
— Опыт настройки backup/restore MariaDB и проверки восстановимости резервных копий;
— Опыт диагностики производительности MariaDB: slow query log, EXPLAIN, индексы, locks, buffer pool, disk IO;
— Опыт эксплуатации Linux-серверов;
— Понимание влияния CPU, RAM, disk IO, network и filesystem на работу ClickHouse и MariaDB;
— Опыт настройки мониторинга и алертов для ClickHouse, MariaDB и инфраструктуры;
— Опыт работы с Prometheus, Grafana, Zabbix или аналогичными системами мониторинга;
— Опыт автоматизации через Ansible, Bash, Python или аналогичные инструменты;
— Умение аккуратно проводить изменения в production: план работ, оценка рисков, rollback-план, проверка результата;
— Умение писать техническую документацию: инструкции, runbook’и, чек-листы, postmortem-отчёты.
Желательные требования:
— Опыт или уверенное понимание Galera Cluster;
— Опыт эксплуатации ClickHouse и MariaDB в составе SIEM, SOC, log management, observability, telemetry или других высоконагруженных систем;
— Опыт работы с большими объёмами данных: десятки или сотни ТБ;
— Опыт работы с ClickHouse Keeper или ZooKeeper;
— Опыт эксплуатации ClickHouse / MariaDB на bare metal;
— Опыт работы с LUN, DAS, локальными дисковыми массивами и S3-совместимыми объектными хранилищами;
— Опыт нагрузочного тестирования ClickHouse и MariaDB;
— Опыт построения процедур disaster recovery;
— Опыт подготовки архитектурных и эксплуатационных документов для заказчиков;
— Опыт работы с ProxySQL, MaxScale, HAProxy, Keepalived, Pacemaker / Corosync или аналогичными решениями;
— Опыт проведения регламентных работ с минимальным downtime;
— Опыт аудита продуктивных инсталляций у заказчиков.
Условия:
— Постоянная занятость;
— Работа с продуктивной, тестовой и лабораторной инфраструктурой;
— Взаимодействие с командой эксплуатации, инженерами SIEM, разработчиками, архитекторами и техническими представителями заказчика;
— Участие в планировании изменений, разборе инцидентов и развитии архитектуры хранения данных.
ОБЗОР ПОЗИЦИИ И ПРОДУКТА
Разработка и поддержка серверной части платформы цифрового ипотечного брокера. Проект создается «с нуля» на современном стеке без легаси.
СТЕК ТЕХНОЛОГИЙ
C# / .NET, ASP.NET Core, Entity Framework Core, PostgreSQL, JWT, паттерны проектирования (Repository, Service Layer, DI).
ЧЕМ ПРЕДСТОИТ ЗАНИМАТЬСЯ
• Разработка и поддержка REST API на ASP.NET Core;
• Работа с базой данных PostgreSQL через Entity Framework Core;
• Интеграция с внешними сервисами (банки, ЭЦП, госсервисы, SMS, хранилище файлов);
• Реализация фоновых задач через Hangfire;
• Поддержка реального времени через SignalR;
• Написание юнит-тестов (NUnit, Moq);
• Участие в code review.
ТРЕБОВАНИЯ К КАНДИДАТУ
• От 1 до 3 лет коммерческого опыта разработки на C# / .NET;
• Уверенное владение C# / .NET и разработка REST API на ASP.NET Core;
• Проектирование реляционных баз данных (PostgreSQL), работа с ORM (Entity Framework Core);
• Понимание принципов REST и HTTP;
• Опыт реализации аутентификации и авторизации (JWT);
• Опыт использования AI-инструментов для разработки (Claude, ChatGPT, GitHub Copilot);
• Навык чтения чужого кода, работы в команде и соблюдение стандартов качества кода.
БУДЕТ ПЛЮСОМ
• Опыт работы с SignalR (WebSocket), Hangfire (или аналоги);
• Опыт интеграции с внешними HTTP-сервисами (IHttpClientFactory, Polly);
• Знание FluentValidation, OpenAPI / Swagger;
• Опыт работы с MinIO или S3-совместимыми хранилищами;
• Понимание Docker, основ контейнеризации и Kubernetes;
• Опыт работы с CI/CD пайплайнами (GitLab CI).
УСЛОВИЯ
• Офлайн работа в офисе (стабильность крупной группы компаний при динамике продуктовой разработки);
• Возможность влиять на архитектуру;
• Культура качественного кода: юнит-тестирование, code review;
• Работа над продуктом с реальным влиянием на бизнес и клиентов.
Задачи:
— Обслуживание и обновление LMS: управление получением пакетов обновлений и их применение к системе LMS, загрузка контейнерных образов и их отправка во внутренний Docker регистр.
— Управление инфраструктурой: локальное развертывание и конфигурация инфраструктуры, выполнение развертывания и настройки кластеров Kubernetes, обслуживание базы данных на выделенном инстансе отдельно от кластера Kubernetes, установка и мониторинг автоматического резервного копирования БД с периодичностью каждые 24 часа.
— Хранилище и пайплайны развертывания: управление доступом к объектным хранилищам (AWS S3 или аналогичным), получение пакетов из назначенных источников и управление их загрузкой в объектное хранилище.
Требования:
— Облачные платформы и инфраструктура: AWS, GCP, Azure; экспертный опыт работы с Docker и Kubernetes (развертывание, конфигурация и оркестрация); уверенное владение подходом Infrastructure as Code (Terraform, Ansible).
— CI/CD и автоматизация: опыт проектирования и поддержки пайплайнов CI/CD (Jenkins, GitLab CI/CD).
— Программирование и скрипты: уверенное владение Python и Go (Golang); навыки написания скриптов на Bash/Shell для автоматизации.
— Мониторинг и Observability: опыт развертывания и управления инструментами мониторинга (Prometheus, Grafana, Zabbix, ELK Stack: ElasticSearch/Kibana).
— Операционные системы: глубокие знания операционных систем на базе Linux (NixOS, Ubuntu Core).
— Понимание микросервисной архитектуры и распределенных систем.
— Знание методологий Agile, стандартов ITIL и процессов управления инцидентами.
— Опыт работы с высоконагруженными средами и проведения аудита инфраструктуры.
Условия:
— Заработная плата обсуждается по результатам собеседования и зависит от навыков кандидата.
— Формат работы — офис (удалёнка не предусмотрена, специфика проекта).
— Москва, Зеленоград, Казань.
— Работа над технологически сложным продуктом на стыке Computer Vision и мобильной разработки.
— Возможности для профессионального роста и влияния на процессы.
Задачи:
— Разрабатывать новую функциональность на базе 1C: Управление МФО и КПК и БИТ.ФИНАНС.МСФО в условиях высоконагруженной информационной базы
— Оптимизировать и поддерживать функциональность в условиях большой кодовой базы
— Писать код в 1C: Enterprise Development Tools
— Выпускать релизы по регламентированному пайплайну, пользоваться Git/GitLab
— Проходить код-ревью своих Merge Request’ов и код-ревью запросов коллег
— Участвовать в командном Task Grooming и вместе с программистами 1C и Golang находить удачные архитектурные решения
— Работать по гибким методологиям вместе с командой (Scrum)
Требования:
— Опыт работы разработчиком 1C не менее 6 лет
— Опыт написания кода в IDE 1C: Enterprise Development Tools
— Знание Git
— Умение решать интеграционные задачи с различными сервисами и другими продуктами 1C (например, HTTP и асинхронный обмен по шине данных)
— Опыт работы с клиент-серверной архитектурой на управляемых формах
— Знание базовых механизмов 1С: БСП
— Глубокое знание работы платформы 1С:Предприятие 8.3
— Опыт разработки решений в многопоточной параллельной обработке данных
— Умение и готовность работать в команде
Будет плюсом:
— Опыт работы с 1С: Управление МФО и КПК
— Опыт работы в компаниях, связанных с финансами, в идеале — с кредитами и займами юридическим и физическим лицам
— Сертификация и аттестация по платформе 1C: Предприятие 8
— Обучение или сертификат по 1С:Эксперт по технологическим вопросам
Условия:
— Работа в команде Банка Ozon, создающей и развивающей сервисы для покупателей и продавцов
— Использование передовых технологий и микросервисной архитектуры
— Работа с процессингом, учётным ядром, финансовым мониторингом, переводами через Систему быстрых платежей
— Разработка продуктов: виртуальная и пластиковая карта, рассрочка, банк для юридических лиц, программы финансирования продавцов
Стек технологий:
— Основной язык: 1C (1C:EDT + Strict Type)
— Дополнительно: Go, Python, C++
— Тестируемость: YaxUnit, Vanessa, E2E на Python
— Хранение / обмен: Kafka, ClickHouse, MS SQL (для 1С), S3 (CEPH), Nginx, Vertica, PostgreSQL (для Go)
— CI / CD: Kubernetes, Docker, Vault, Keycloak, GitLab + Git
— Наблюдаемость: Prometheus, Thanos, Grafana, Alert registry (на Prometheus Rules), ЦКК, 1SMonitor
— Безопасность: Vault, Keycloak, Kerberos, AD, splunk, LDAP
— Трекер задач: Jira
— Документация: Confluence, Holst, PlantUML
— Управление проектами: Квартальное планирование, Scrum poker planning
АС DLP – автоматизированная система контроля возможных каналов утечек конфиденциальной информации, проведения расследований инцидентов ИБ и ретроспективного анализа. Крупнейшая промышленная инсталляция в Европе: десятки тысяч ядер CPU, петабайты трафика, миллисекунды SLA на проверку «в разрыв», самые современные методы детектирования, в том числе с использованием искусственного интеллекта.
Задача – разработка функциональной подсистемы проверок контента на наличие конфиденциальной информации методами AI.
Задачи:
— участие в проектах по развитию решений в области информационной и кибербезопасности
— участие в проектировании решений в соответствии с существующим архитектурным ландшафтом Банка.
Мы ждем от кандидата:
— высшее образование в ИТ направлении
— понимание принципов ООП и знание основных паттернов проектирования ПО
— опыт коммерческой разработки от 3-х лет на Java, использования Spring Framework (Spring Boot, Spring MVC, Spring Security, Spring Data JPA) и Unit-тестов (Junit)
— опыт написания rest вебсервисов и openapi документации к ним
— опыт работы с Kafka, с инструментами миграции баз данных (Liquibase), PostgreSQL (сложные запросы, оптимизация запросов и структур хранения)
— опыт работы с Git, Maven
— понимание принципов работы инструментов CI/CD (Docker, k8s, Jenkins)
— опыт работы с многопоточностью и виртуальными потоками в частности.
Будет дополнительным плюсом:
— опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов.
— опыт работы с S3 совместимыми хранилищами
— знание алгоритмов, структур данных
— опыт работы в высоконагруженных проектах
— знание протоколов SMTP, ICAP.
Мы предлагаем:
— комфортный офис по адресу г. Москва, ул. Ваваилова, 23
— формат - только офис
— ежегодный пересмотр зарплаты, годовая премия
— корпоративный спортзал и зоны отдыха
— более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
— расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
— гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
— подписка Прайм с возможностью совместного использования на трёх близких
— вознаграждение за рекомендацию друзей в команду Сбера.
Задачи:
— Анализ требований: полнофункциональное выявление бизнес-, пользовательских, функциональных и нефункциональных требований к data-платформенным решениям
— Декомпозиция бэклога: разбиение крупных инициатив на эпики, фичи, User Stories и задачи с определением критериев DoD и AC
— Проведение R&D: исследовательские работы, изучение новых подходов, анализ tech trends, создание прототипов решений
— Проектирование интеграций: детальное проектирование межсистемных интеграций и потоков данных с микросервисами, внешними потребителями и AI-агентами
— Документирование: подготовка технических требований, API-контрактов (REST/JSON, Kafka-схема), ADR, спецификаций
— Моделирование данных: проектирование концептуальных, логических и физических моделей данных, ER-диаграммы, нормализация/денормализация
— Проектирование событийно-ориентированных архитектур: моделирование потоков данных через Kafka, определение схем событий и SLA доставки
— Согласование: проведение согласований технических требований со стейкхолдерами, техническими лидами и владельцами продукта
— Участие в приёмочном тестировании: проверка реализованного функционала на соответствие требованиям и спецификациям
— Разбор инцидентов: участие в расследовании инцидентов, анализ root cause, формализация требований на исправления и превентивные меры
Требования:
Опыт и экспертиза:
— Самостоятельное выявление и формализация требований к информационным системам
— Опыт проектирования data-решений: ETL/ELT-пайплайны, хранилища данных, data pipelines
— Уверенное знание SQL (оконные функции, CTE, джойны)
— Понимание событийно-ориентированной архитектуры и брокеров сообщений (Kafka)
— Владение REST/JSON/JSON Schema, проектирование и ревью API-контрактов
— Понимание микросервисной архитектуры и её паттернов
Проектирование и моделирование:
— UML: диаграммы последовательностей, компонентов, развёртывания, состояний
— DDD: понимание bounded contexts, агрегатов, доменных событий и применение при формировании требований к микросервисам
— Проектирование ER-диаграмм уровня продакшна
Работа с данными:
— Понимание принципов проектирования data-хранилищ: концептуальная, логическая, физическая модели
— Опыт описания контрактов данных: схемы, валидация, версионирование
— Понимание тематики Kafka: topic naming, partitioning strategy, schema registry
Инструментарий:
— Проектирование: PlantUML, draw.io, Miro или аналоги
— Клиент-серверные взаимодействия: Postman, Insomnia или аналоги
— Мониторинг и наблюдаемость: принципы построения дашбордов (Grafana, Kibana)
— Опыт использования AI-инструментов (LLM, AI CLI-ассистенты, IDE-плагины) для подготовки документации и ревью требований
Soft Skills:
— Системное мышление, выявление рисков и точек отказа
— Уверенная устная и письменная коммуникация
— Управление конфликтами интересов стейкхолдеров, нахождение консенсуса, эскалация
— Активное слушание, умение задавать правильные вопросы (5 Why, Jobs-to-be-done)
— Способность вести несколько проектов параллельно, управлять приоритетами
Будет плюсом:
— Опыт в HR-Tech / HR-аналитике
— Опыт проектирования data-инструментов (каталог данных, системы data lineage)
— Опыт работы с ClickHouse, Redis, S3
— Практический опыт взаимодействия/разработки AI-агентов
— Понимание основ безопасности: шифрование, аутентификация, аудит данных
— Навыки работы с генеративными AI-моделями, создание и использование AI-агентов
— Опыт использования GigaChat, Kandinsky и аналогов
— Инструментальное владение AI для анализа, генерации и автоматизации
Условия:
— Инновационные проекты и задачи для профессионального роста
— Среда для обмена знаниями с высокой экспертизой внутри команды
— Сплочённая команда
— Культура, создаваемая сотрудниками, поддержка корпоративных комьюнити
— Стабильная зарплата и годовой бонус
— Гибридный формат работы
— Современный IT-офис рядом с метро "Кутузовская" с фитнес-залом
— Более 400 образовательных программ СберУниверситета
— Расширенный ДМС, льготное страхование для семьи, корпоративная пенсия
— Гибкий дисконт по ипотечному кредиту
— Подписка Прайм с возможностью использования трёх близких
— Вознаграждение за рекомендацию друзей в команду Сбера
Задачи:
— Проектирование, развёртывание и развитие инфраструктуры платформы искусственного интеллекта (on-prem и облако): Kubernetes-кластеры, GPU-ноды, storage, сети, безопасность.
— Построение и поддержка CI/CD/CT-пайплайнов для ML-моделей и сервисов: от артефакта DS до продакшн-инференса с откатами и канареечными релизами.
— Интеграция и эксплуатация LLM/ML-сервисов для внутренних команд и рыночных внедрений: упаковка моделей в сервисы, конфигурация autoscaling, SLA, observability.
— Настройка мониторинга и алертинга по инфраструктуре и моделям (метрики ресурсов, latency, ошибки, дрейф данных), реагирование на инциденты, участие в post-mortem.
— Автоматизация ML-пайплайнов: подготовка данных, обучение, переобучение, регистрация моделей, управление версиями и окружениями.
— Поддержка внедрений у клиентов: тиражирование платформенных компонентов, адаптация инфраструктуры под контур заказчика, участие в performance-оптимизации и cost-cutting (GPU/CPU).
Требования:
— Высшее образование.
— Опыт работы: 5+ лет.
— Глубокое понимание жизненного цикла ML-модели: от экспериментов до продакшн-инференса и мониторинга.
— Уверенный Linux, сетевые основы, безопасность, работа с контейнерами и оркестраторами.
— Опыт построения CI/CD-пайплайнов для сервисов и ML-артефактов (Docker images, модели, данные).
— Опыт с LLM/GenAI-платформами: vLLM, TGI, Hugging Face, Triton/ONNX Runtime, оптимизация инференса.
— Опыт построения feature store, model registry, ML pipelines (Kubeflow, MLflow, Airflow, Argo Workflows).
— Работа в гибридной инфраструктуре: on-prem кластеры + публичные облака (T1 Cloud, VK Cloud, Yandex Cloud и др.).
— Понимание cost-optimization: FinOps для GPU/CPU, автобалансировка нагрузок.
— Языки: Python (утилиты, обвязка) / Bash.
— Контейнеризация и оркестрация: Docker, Docker Compose, Kubernetes (Helm, Operators), желательно Kubeflow.
— CI/CD: GitLab CI / GitHub Actions / Jenkins / Argo CD.
— Инфраструктура: Terraform / Ansible, конфигурация Linux-серверов, Nginx, cert-manager.
— Data/ML-инфраструктура: Apache Kafka, Airflow/Argo Workflows, S3-совместимые хранилища, MLflow/Weights&Biases.
— Мониторинг и логи: Prometheus, Grafana, Loki/ELK, Sentry, alertmanager.
Профессиональные навыки:
— Проектирование и развёртывание инфраструктуры платформы ИИ (кластер Kubernetes, storage, сети, security) под LLM/ML-нагрузки.
— Построение воспроизводимых ML-пайплайнов: обучение, валидация, packaging модели, деплой в batch и real-time режимах.
— Настройка мониторинга моделей: метрики качества, дрейф данных, latency/throughput, автоматический rollback и retraining-триггеры.
— Совместная работа с DS/разработчиками и внедренцами: перевод экспериментальных ноутбуков в надёжные сервисы для внутренних и внешних клиентов.
Специализированные программы:
— GitLab / GitHub, Jira / Confluence/Сфера
— Kubernetes ecosystem: kubectl, Helm, K9s, Lens.
— ML-инструменты: MLflow / Weights & Biases, Kubeflow Pipelines / Airflow, model registry.
— Мониторинг: Prometheus, Grafana, Loki/ELK, Alertmanager, Sentry.
Задачи:
- Управление людьми: проведение 1-1 встреч, мотивация и развитие сотрудников, организация Performance review
- Управление командой: найм, onboarding, повышение, ФОТ, увольнение
- Техническая экспертиза: разработка (до 30% от обязанностей), дизайн архитектуры, Code Review, развитие инженерной культуры
- Плотная работа с Product Owner, межкомандные коммуникации, понимание бизнес-метрик
- Постановка квартальных целей команды (OKR) и Roadmap, постановка целей спринта
- Scrum Master, системная работа с тех. долгом и багами
Требования:
- Опыт на позиции руководителя не менее 2 лет — управление кросс-функциональной командой (BE, FE, QA, UX)
- Реальный опыт построения процессов в команде (Scrum / Kanban)
- Опыт разработки на Golang от 3 лет (уровень ME+ или SE)
- Навык проектирования архитектуры сложных геораспределённых систем
- Опыт найма сотрудников в команду и формирования команды
- Опыт стратегического (до 1 года) и тактического (1 квартал) планирования работы команды разработки
Будет плюсом:
- Опыт проектирования и эксплуатации высоконагруженных сервисов
- Опыт работы с AWS S3
- Опыт работы с Ceph
ГибридleadМосква
Зарплата не указана
Удалённоsenior
10 669 – 14 435 $
ОфисseniorЛимассол
Зарплата не указана
middle
Зарплата не указана
ГибридseniorМосква
Зарплата не указана
senior
Зарплата не указана
Все вакансии в одном месте — страница 3 · Job Hunters