Задачи:
— участие в долгосрочном проекте по обезличиванию данных в формате ИП
Требования:
— опыт работы от 3 лет в роли ML-инженера / Data Scientist
— опыт разработки и внедрения ML-моделей в продакшен
— знание Python, pandas, numpy, scikit-learn
— опыт работы с NLP-инструментами: SpaCy, Hugging Face Transformers
— практический опыт построения пайплайнов обработки неструктурированных данных
— очистка, нормализация, feature engineering
— извлечение сущностей (NER)
— понимание и опыт применения деревьев решений и ансамблей (Random Forest)
— умение интерпретировать результаты, подбирать гиперпараметры, оценивать риски переобучения
— опыт работы с CTGAN и TVAE (библиотека SDV или аналоги): обучение, подбор гиперпараметров
— проведение privacy-проверок
— контейнеризация (Docker)
— развертывание моделей через API (FastAPI/Flask)
— версионирование моделей и данных (MLflow/DVC)
— понимание CI/CD-процессов
Условия:
— формат сотрудничества: ИП
— тип занятости: долгосрочный проект
Контакты работодателя доступны по кнопке «Откликнуться» после входа.