Задачи:
— работать с большими данными в экосистеме Hadoop (PySpark, SQL) — от выгрузки и разведки до построения витрин для моделей
— разрабатывать индивидуальные модели эластичности и клиентского поведения в сегменте B2C — от прототипа до продвинутого пайплайна обучения и предсказаний
— проверять бизнес-гипотезы и превращать их в измеримый эффект: дизайн и оценка A/B-тестов (мэтчинг, продвинутые методы causal inference, интерпретация результатов)
— выстраивать коммуникацию с заказчиками: согласовывать метрики, защищать подходы, показывать ценность данных на понятном языке
— обеспечивать надёжность и мониторинг внедрённых решений — чтобы модель работала стабильно и приносила пользу каждый день.
Требования:
— опыт работы Data Scientist от 2х лет
— техническое образование (будет плюсом если выпускник - МГУ, МФТИ, ВШЭ и других ведущих вузов страны)
— понимание теории вероятностей и статистики
— уверенное владение широким спектром ML-алгоритмов — регрессия, классификация, кластеризация, а также uplift-моделирование (способность оценивать причинно-следственные эффекты, а не просто предсказывать)
— владение Python и ML библиотеками (numpy, sklearn, pandas, matplotlib/seaborn/plotly, catboost/lightgbm/xgboost, etc.)
— плюсом будет опыт работы с pytorch, pyspark
Условия:
— комфортный современный офис рядом с м. Кутузовская
— возможность выбрать удобный график – офис/гибрид
— ежегодный пересмотр зарплаты, квартальная и годовая премия (премия указывается в зависимости от должности и системы премирования)
— корпоративный спортзал и зоны отдыха
— более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
— программа адаптации и помощь руководителя на старте (для вакансий уровня Junior)
— расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
— гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
— подписка Прайм с возможностью совместного использования на трёх близких
— вознаграждение за рекомендацию друзей в команду Сбера.
Компания Symfa ищет Middle Data Quality Engineer / BA для удалённой работы из стран ЕС, Грузии или Сербии. В обязанности входит обеспечение качества данных, анализ бизнес-требований и взаимодействие с командами разработки. Кандидат должен обладать опытом работы с данными, навыками анализа и пониманием процессов контроля качества. Требуется умение работать с инструментами для проверки и валидации данных, а также способность выявлять и документировать проблемы с данными. Важны коммуникационные навыки для взаимодействия с различными отделами и понимание бизнес-процессов в сферах финансов, страхования, здравоохранения, недвижимости, туризма и HoReCa.
Задачи:
— Погрузиться в работу с крупными массивами информации
— Проектировать логику аналитических выборок и отчётов
— Обрабатывать транзакционные данные: продажи, чеки, заказы — собирать агрегаты и обогащать исходные данные
— Писать сложные SQL-запросы
— Превращать запросы бизнеса в понятные ТЗ для отчётов и витрин
— Разбираться в расхождениях: находить причины, анализировать ошибки
— Настраивать метрики и фильтры для BI
Требования:
— 4–5+ лет в роли аналитика данных
— Опыт именно в Pharma — обязателен
— Уверенная работа с большими данными
— Продвинутый SQL и Excel, опыт с ClickHouse или другими колоночными СУБД
— Умеете писать SQL самостоятельно, без генерации нейросетями
— Строили отчётность на справочниках и аналитических агрегатах
— Можете ставить ТЗ на разработку отчётов
— Ищете оптимальное решение: по скорости, ресурсам и нагрузке на БД
— Высшее образование
— Гражданство РФ и фактическое нахождение в России
Условия:
Удалённоsenior
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Задачи:
— проектировать ML-системы для ценообразования, промоаллокации и прогнозирования спроса
— анализировать эксперименты
— встраивать модели в продукт
Компания TWINBY разрабатывает современное мобильное приложение для знакомств, которое соединяет пользователей, ориентируясь не на внешность или случайные фотографии, а на их психологическую совместимость. Вакансия предполагает удалённую работу в роли Data Engineer, где специалист будет заниматься обработкой и анализом данных, необходимым для функционирования сервиса.
– Разработка, создание и поддержка надежных конвейеров обработки данных и процессов ETL/ELT для поддержки различных источников данных, включая структурированные и неструктурированные данные, с обеспечением высокого качества и целостности данных. Хороший опыт работы с Databricks.
💎 Создание и развитие собственных базовых языковых моделей Авито: проверка гипотез в области претрейна, continual pre-training, post-training, RL и синтетических данных, масштабирование обучения и оптимизация инференса (квантование, speculative decoding), построение процедур оценки качества моделей, написание продакшен-кода на Python и PyTorch.
разработка PoC и MVP AI-агентов с использованием фреймворков для работы с LLM. адаптация и дообучение LLM на внутренних и внешних данных (SFT, LoRA, DPO, GRPO).
разработка, тестирование и внедрение ИИ-агентов (в том числе LLM-as-a-Judge) и классических ML-моделей для оценки качества, детекции аномалий, прогнозирования деградации и автоматической локализации причин сбоев. исследование и внедрение новых подходов в области настройки LLM, LLM-as-a-Judge и RAG, чтобы сделать мониторинг точнее, стабильнее и понятнее.
работать с таргетами, полученными из анкет и интервью с помощью экспертной и LLM-разметки. подбирать постановку задачи в зависимости от объема и качества данных: supervised learning, weak supervision, few-shot и другие подходы.
проектировать и реализовывать end-to-end LLM-пайплайны, включая продвинутые RAG-системы (индексация, ретривал, ранжирование, генерация). разрабатывать автономных AI-агентов с использованием планирования, вызова инструментов (function calling) и мультиагентной оркестрации.
Сопровождение ML-решений (мониторинг сервисов и моделей, отслеживание дрейфа данных, работа над развитием); Оценка влияния на бизнес предложенных решений;
• Разработка моделей эластичности для различных групп клиентов, кластеризации клиентов по их поведенческим характеристикам. • Разработка поведенческих моделей для прогнозирования динамики объемов различных сегментов розничного портфеля Банка в множестве сценариев на периоде жизни портфеля.
Требования:
— Опыт миграции ETL-систем (желательно с Oracle/Informatica на Apache стек)
— Глубокий SQL: оконные функции, сложные джойны, иерархические запросы
— Оптимизация SQL для highload (партиционирование, индексы, explain plans)
— Oracle (PL/SQL) и PostgreSQL
— Greenplum и/или Clickhouse
— Проектирование архитектур на Apache Spark (PySpark), NiFi, Airflow
— Hadoop (HDFS) и Hive
— Мониторинг ETL: Grafana/Prometheus или Victoria Metrics
— Опыт работы с биллинговыми системами (желательно телеком-домен)
Преимущества:
— Потоковая обработка: Kafka Streams / Spark Streaming
— Informatica PowerCenter (понимание мигрируемой системы)
— Бинарные форматы хранения в Hadoop
— Различия: Hive vs Impala, Greenplum vs PostgreSQL, Clickhouse vs PostgreSQL
— Patroni для кластеризации PostgreSQL/Greenplum
— S3-хранилища
— КриптоПро или защищенные каналы передачи данных
Задачи:
— Миграция ETL-системы телеком-оператора с Oracle/Informatica на Apache стек (S3, Airflow, NiFi, Kafka, Greenplum)
— Перенос бизнес-логики из Informatica в высокопроизводительный SQL-код
— Написание и оптимизация SQL для витрин данных и ETL-процессов
— Разработка DAG-ов в Airflow
— Настройка пайплайнов в NiFi (источники: Oracle, PostgreSQL; приемники: S3, файловые архивы)
— Разработка Spark-джобов (PySpark) для больших объемов
— Интеграция с Kafka для потоковой передачи
— Настройка мониторинга (Grafana/Prometheus) и отслеживание метрик
— Разбор инцидентов по качеству данных и ошибкам загрузки
— Code review
-Подготовкой математического ядра для сервисов, связанных с поиском на Фарпосте. -Помогать улучшать инфраструктуру и внедрять современные инженерные практики для наших сервисов.
ГибридmiddleВладивосток
Зарплата не указана
Все вакансии в одном месте — страница 3 · Job Hunters