На этой позиции вы будете отвечать за администрирование облачных платформ, автоматизацию CI/CD, Infrastructure as Code, контейнеризированные среды. Важной частью роли станет обеспечение стабильной и эффективной инфраструктуры для BI-сервисов, data-driven приложений и сопутствующих систем.
-Проектирование и сопровождение БД: разработка и поддержка объектов базы данных (таблицы, представления, индексы, хранимые процедуры) в среде Greenplum. -Разработка витрин данных: проектирование и расчет показателей для витрин данных под бизнес-задачи с использованием SQL.
– Анализировать готовые бизнес-требования и собирать дополнительные требования непосредственно у заказчиков; – Создавать и декомпозировать задачи в Kaiten;
Удалённоmiddle
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
As a Principal Infrastructure Architect on our Infrastructure Architecture team, you will be the architecture team's partner to ZoomInfo's data engineering organization. You bring the infrastructure patterns, evaluation rigor, and cross-team alignment that help them build and run those platforms well on GCP.
– Разработка, создание и поддержка надежных конвейеров обработки данных и процессов ETL/ELT для поддержки различных источников данных, включая структурированные и неструктурированные данные, с обеспечением высокого качества и целостности данных. Хороший опыт работы с Databricks.
• Разработка моделей эластичности для различных групп клиентов, кластеризации клиентов по их поведенческим характеристикам. • Разработка поведенческих моделей для прогнозирования динамики объемов различных сегментов розничного портфеля Банка в множестве сценариев на периоде жизни портфеля.
Требования:
— Опыт миграции ETL-систем (желательно с Oracle/Informatica на Apache стек)
— Глубокий SQL: оконные функции, сложные джойны, иерархические запросы
— Оптимизация SQL для highload (партиционирование, индексы, explain plans)
— Oracle (PL/SQL) и PostgreSQL
— Greenplum и/или Clickhouse
— Проектирование архитектур на Apache Spark (PySpark), NiFi, Airflow
— Hadoop (HDFS) и Hive
— Мониторинг ETL: Grafana/Prometheus или Victoria Metrics
— Опыт работы с биллинговыми системами (желательно телеком-домен)
Преимущества:
— Потоковая обработка: Kafka Streams / Spark Streaming
— Informatica PowerCenter (понимание мигрируемой системы)
— Бинарные форматы хранения в Hadoop
— Различия: Hive vs Impala, Greenplum vs PostgreSQL, Clickhouse vs PostgreSQL
— Patroni для кластеризации PostgreSQL/Greenplum
— S3-хранилища
— КриптоПро или защищенные каналы передачи данных
Задачи:
— Миграция ETL-системы телеком-оператора с Oracle/Informatica на Apache стек (S3, Airflow, NiFi, Kafka, Greenplum)
— Перенос бизнес-логики из Informatica в высокопроизводительный SQL-код
— Написание и оптимизация SQL для витрин данных и ETL-процессов
— Разработка DAG-ов в Airflow
— Настройка пайплайнов в NiFi (источники: Oracle, PostgreSQL; приемники: S3, файловые архивы)
— Разработка Spark-джобов (PySpark) для больших объемов
— Интеграция с Kafka для потоковой передачи
— Настройка мониторинга (Grafana/Prometheus) и отслеживание метрик
— Разбор инцидентов по качеству данных и ошибкам загрузки
— Code review
О нас за минуту
DV Group — это eRetail маркетинг. У нас две собственные платформы:
CDP (DV Platform) — сегментирует покупателей по чековым данным, MAID, строит Sales Lift.
DSP (DV Programmatic) — закупает трафик в RTB с таргетингом на реальных онлайн-покупателей (не на интересы). Уникальная интеграция с ПБД.
Что предстоит делать
Разработка и внедрение ML-моделей
Анализ больших объемов данных
Построение recommendation / prediction моделей
Подготовка и очистка данных
Проведение A/B тестов
Написание сложных запросов ClickHouse и их оптимизация
Взаимодействие с frontend-разработчиками, backend-разработчиками, аналитиками, product-менеджером и DevOps
Кто нам нужен
Python, SQL, Spark, ClickHouse
pandas, numpy, scikit-learn
Опыт работы с ML-моделями
Работа с оркестраторами (Dagster, Airflow) и Kubernetes
Понимание статистики и теории вероятностей
Способность разрабатывать надежные ETL пайплайны
Что предлагаем
Зарплата:
200 000 – 220 000 ₽ оклад net + годовая премия
Формат:
гибрид или полная удалёнка, но ты проживаешь в РФ
График:
10:00–19:00
ДМС
со стоматологией после испытательного срока, локация Москва
Свой
бариста
в офисе и правда классный
Экспертная среда
— никакой скуки, только реальные AdTech-задачи и возможность влиять на продукт
Продукт в
реестре отечественного ПО
— это важно для нас и для клиентов.
-Разработка генеративных ИИ-моделей для синтеза визуального и проектного контента на основе структурированных данных товарного каталога в рамках проверки гипотез (PoC) внутри корпоративной платформы по оценке ИИ-инициатив. -Построение системы метрик: разработка офлайн- и онлайн-показателей, кросс-валидация, прямая оценка бизнес-эффекта.
• Администрировать и поддерживать Linux-инфраструктуру: 2 000+ виртуальных машин и 500+ физических серверов. • Работать с PostgreSQL и Greenplum, включая troubleshooting производительности и надёжности.
As the Senior Staff Machine Learning Platform Engineer, you will own the technical vision and evolution of Faire’s ML platform. You will set standards, influence org-wide architecture, and lead complex, cross-functional initiatives that unlock data science velocity at scale.
-Design, build, and maintain data infrastructure and pipelines spanning both batch and real-time / streaming workloads, contributing to architectural decisions along the way. -Build and maintain scalable, efficient, and reliable ETL/ELT pipelines using languages and frameworks such as Python, SQL, Spark, Flink, Beam, or equivalents.