Описание вакансии
Коротко о ролиОпыт проектирования высоконагруженных распределённых систем: горизонтальное масштабирование, отказоустойчивость, балансировка нагрузки, кэширование, очереди, rate limiting, graceful degradation. Опыт встраивания ML-сервисов в корпоративную архитектуру: интеграция с API Gateway, IAM/SSO, корпоративными шинами, системами мониторинга и журналирования.
Задачи:
— Проектирование архитектуры высоконагруженных распределённых систем с горизонтальным масштабированием, отказоустойчивостью, балансировкой нагрузки, кэшированием, очередями, rate limiting, graceful degradation.
— Проектирование архитектуры ML/LLM-сервисов для промышленной эксплуатации: inference-serving, batch/online processing, fvector storage, orchestration пайплайнов, GPU workload management.
— Встраивание ML-сервисов в корпоративную архитектуру: интеграция с API Gateway, IAM/SSO, корпоративными шинами, системами мониторинга и журналирования.
— Применение микросервисной и событийной архитектуры: микросервисный подход, SOA, event-driven architecture, async-взаимодействия, брокеры сообщений и потоковая обработка данных.
— Контейнеризация и оркестрация с использованием Docker, Kubernetes, Helm, ingress/service mesh, деплой и эксплуатация контейнеризированных решений.
— Проектирование решений для облачной и on-prem архитектуры, включая hybrid architecture, multi-zone deployment, disaster recovery, backup/restore, SLA/SLO/SLI.
— Проектирование интеграционных технологий и API: REST, WebSocket, контрактов взаимодействия, схем авторизации и маршрутизации.
— Обеспечение безопасности и соответствия корпоративным стандартам: TLS/mTLS, JWT, OAuth2, OIDC, SAML/ADFS, RBAC/ABAC, secrets management, защита ПДн и чувствительных данных.
— Архитектура хранения и обработки данных с PostgreSQL, Redis, Object Storage.
— Проектирование мониторинга и сопровождения сервисов: метрики, логи, трассировки, алерты, capacity planning, performance profiling, incident/problem management.
— Применение MLOps / DevOps практик: CI/CD для ML-сервисов, model registry, experiment tracking, reproducibility.
— Использование Python, SQL, Bash, Git для разработки и проектирования архитектуры.
— Подготовка архитектурной документации: C4/UML, схемы интеграции, NFR, ADR, security/data flow diagrams.
Требования:
— Практический опыт работы системным/solution/enterprise architect от 3 лет, общий опыт в ИТ от 5 лет.
— Опыт с LLM-продуктами или платформами данных.
Дополнительно:
— Опыт проектирования GPU-инфраструктуры и inference-контуров для LLM/embedding/reranking сервисов.
— Понимание особенностей vLLM, Triton Inference Server, ONNX Runtime, MLflow, ClearML.
— Опыт выбора архитектуры под разные профили нагрузки: low latency / high throughput / batch / streaming.
— Навык оценки стоимости владения архитектурой: CAPEX/OPEX, стоимость GPU/CPU/Storage/Network.
— Опыт проектирования мультитенантных платформ и контуров изоляции.
— Знание практик FinOps / Capacity planning будет плюсом.
— Опыт прохождения архитектурных комитетов, согласования решений с ИБ, инфраструктурой и корпоративными архитекторами.
— Навык формализации нефункциональных требований: производительность, доступность, безопасность, сопровождаемость, масштабируемость.
— Понимание специфики корпоративной интеграции: legacy-системы, ограниченные контуры.
Условия:
— Работа по договору с ИП (статус ИП у кандидата).
— Удалённый формат работы.
— Срок работы до конца ноября с возможной пролонгацией.
— Почасовая оплата от 1500 до 2000 рублей без НДС.