Задачи:
— Участвовать в проектировании и реализации высокопроизводительных, масштабируемых и оптимизированных дата-решений.
— Создавать модели данных с нуля, используя сильные навыки SQL.
— Писать и оптимизировать SQL-запросы внутри приложений.
— Обеспечивать производительность, безопасность и доступность баз данных.
— Готовить документацию и технические спецификации.
— Выполнять процедуры с базами данных: обновления, резервное копирование, восстановление и миграция.
— Профилировать использование ресурсов сервера и оптимизировать конфигурации.
— Проектировать, строить и автоматизировать развертывание дата-пайплайнов и приложений.
— Интегрировать данные из локальных баз и внешних источников через REST API и инструменты сбора данных.
— Сотрудничать с бизнес-подразделениями и командами дата-сайенс по вопросам доступа, трансформации, обработки и отчетности данных.
— Поддерживать внедрение, технические вопросы и обучение, связанные с экосистемой data lake.
— Управлять AWS-ресурсами, включая кластеры EMR и ECS.
— Поддерживать обеспечение, мониторинг, конфигурацию и обслуживание AWS-инструментов.
— Оценивать и внедрять новые облачные технологии для улучшения возможностей и снижения затрат.
— Поддерживать автоматизацию с использованием Infrastructure as Code (Terraform) и CI/CD (Jenkins).
— Реализовывать управление данными, контроль доступа и снижение рисков безопасности.
Требования:
— 7-9 лет опыта проектирования и разработки облачных моделей данных, ETL-пайплайнов и инфраструктуры.
— Опыт работы с структурированными и неструктурированными данными.
— Отличное владение SQL для популярных баз данных.
— Опыт оптимизации больших и сложных SQL-запросов.
— Знание лучших практик реляционных баз данных.
— Опыт настройки движков баз данных и оркестрации кластеров.
— Умение планировать ресурсы по высоким спецификациям.
— Навыки устранения типичных проблем с базами данных.
— Опыт работы со Spark, Glue, EMR, Apache Kafka или AWS Kinesis.
— Опыт с системами контроля версий Git или Subversion.
— Опыт использования автоматизированных систем сборки и CI/CD.
— Программирование на Java, Python и Scala.
— Знание структур данных и алгоритмов.
— Знание реляционных, NoSQL, графовых, документных, key-value и временных баз данных.
— Знание масштабируемого проектирования и управления моделями данных.
— Знание деплоя ML-моделей.
— Знание AWS cloud платформ.
— Знание TDD и BDD.
— Сильный интерес к улучшению навыков разработки ПО, фреймворков и технологий.
Условия:
— Возможность работать с моделированием данных, сервисами данных и дата-сайенсом в рамках платформы Data Intelligence.
— Работа в разнообразной технической среде: AWS, ETL-пайплайны, базы данных, поисковые технологии, рекомендательные системы.
— Прямое взаимодействие с командами дата-сайенс и внутренними заинтересованными сторонами по вопросам отчетности, трансформации и возможностей платформы.
Контакты работодателя доступны по кнопке «Откликнуться» после входа.