Задачи:
— Администрирование и сопровождение Linux-серверов на базе Ubuntu, Debian и AlmaLinux.
— Работа с Docker: создание и запуск контейнеров, Dockerfile, docker-compose, работа с образами и registry.
— Базовое сопровождение Kubernetes: работа с Pod, Deployment, Service, ConfigMap, Secret, Ingress и troubleshooting типовых проблем.
— Работа с Helm для установки и настройки Kubernetes-приложений.
— Работа с Git и GitLab: ветки, merge/rebase, разрешение конфликтов, работа с удалёнными репозиториями.
— Настройка и поддержка простых CI/CD-пайплайнов в GitLab CI/CD.
— Настройка мониторинга и логирования с использованием Prometheus, Grafana.
— Работа с Nginx, базовая диагностика проблем с доступностью сервисов.
— Автоматизация рутинных задач с помощью Bash и Ansible.
Требования:
— Опыт работы с Linux-инфраструктурой.
— Знание Docker, Kubernetes и CI/CD.
— Опыт работы с Git и GitLab.
— Навыки настройки мониторинга и логирования.
— Умение работать с документацией и командной строкой Linux.
Условия:
— Формат работы: удалённо или гибрид.
— Занятость: full-time.
— Зарплата: от 150000 ₽ net.
Технический стек:
— Linux / Infra: Ubuntu, AlmaLinux, Nginx, Bash.
— Контейнеризация и оркестрация: Docker, Docker Compose.
— GitOps / CI/CD: GitLab CI/CD.
— Автоматизация: Ansible, Bash, Python.
— Observability: Grafana, Prometheus.
— Базы данных: PostgreSQL, MySQL.
Задачи:
— Администрировать продуктивные и тестовые кластеры ClickHouse, контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц;
— Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой;
— Анализировать системные таблицы ClickHouse и состояние кластера;
— Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц;
— Планировать горизонтальное масштабирование ClickHouse-кластера;
— Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера;
— Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище;
— Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям;
— Настраивать и сопровождать ClickHouse Keeper / ZooKeeper;
— Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия;
— Разрабатывать и проверять backup/restore и disaster recovery;
— Настраивать мониторинг, алерты и дашборды по ClickHouse;
— Готовить Ansible playbooks / roles, runbook’и, инструкции, чек-листы и технические отчёты.
— Администрировать продуктивные и тестовые инсталляции MariaDB;
— Контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов;
— Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication;
— Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах;
— Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster;
— Настраивать, сопровождать и диагностировать Galera Cluster;
— Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски;
— Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий;
— Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO;
— Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети;
— Настраивать TLS/SSL для клиентских подключений и репликации;
— Настраивать мониторинг, алерты, дашборды и runbook’и по MariaDB.
— Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой;
— Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации;
— Формулировать технические гипотезы, проверять их и отделять первопричину от сопутствующих факторов;
— Готовить технические выводы по итогам инцидентов и участвовать в postmortem-разборах;
— Разворачивать тестовые стенды ClickHouse и MariaDB для проверки архитектурных решений;
— Проверять обновления, изменение топологии, расширение хранилища, storage policy и параметры ClickHouse / MariaDB до применения в production;
— Автоматизировать типовые операции через Ansible / Bash / Python / Terraform или аналогичные инструменты;
— Взаимодействовать с заказчиками, объяснять технические риски понятным языком, предлагать решения и лидировать технические обсуждения.
Требования:
— Практический опыт промышленной эксплуатации ClickHouse;
— Понимание архитектуры ClickHouse: shards, replicas, Distributed tables, ReplicatedMergeTree, MergeTree family;
— Опыт диагностики replication queue, merges, mutations, insert/select latency, деградации запросов и проблем с дисковой подсистемой;
— Понимание партиционирования, ключей сортировки, TTL, storage policies, disks, volumes, data skipping indexes;
— Опыт изменения топологии ClickHouse-кластера или глубокое понимание порядка и рисков таких изменений;
— Опыт настройки TLS/SSL для ClickHouse;
— Опыт эксплуатации MariaDB в продуктивной или близкой к продуктивной среде;
— Понимание MariaDB, InnoDB, транзакций, индексов, блокировок, deadlocks, isolation levels;
— Опыт настройки и диагностики репликации MariaDB;
— Понимание GTID, binary logs, relay logs, replication lag, failover и рисков master-master-репликации;
— Опыт настройки backup/restore MariaDB и проверки восстановимости резервных копий;
— Опыт диагностики производительности MariaDB: slow query log, EXPLAIN, индексы, locks, buffer pool, disk IO;
— Опыт эксплуатации Linux-серверов;
— Понимание влияния CPU, RAM, disk IO, network и filesystem на работу ClickHouse и MariaDB;
— Опыт настройки мониторинга и алертов для ClickHouse, MariaDB и инфраструктуры;
— Опыт работы с Prometheus, Grafana, Zabbix или аналогичными системами мониторинга;
— Опыт автоматизации через Ansible, Bash, Python или аналогичные инструменты;
— Умение аккуратно проводить изменения в production: план работ, оценка рисков, rollback-план, проверка результата;
— Умение писать техническую документацию: инструкции, runbook’и, чек-листы, postmortem-отчёты.
Желательные требования:
— Опыт или уверенное понимание Galera Cluster;
— Опыт эксплуатации ClickHouse и MariaDB в составе SIEM, SOC, log management, observability, telemetry или других высоконагруженных систем;
— Опыт работы с большими объёмами данных: десятки или сотни ТБ;
— Опыт работы с ClickHouse Keeper или ZooKeeper;
— Опыт эксплуатации ClickHouse / MariaDB на bare metal;
— Опыт работы с LUN, DAS, локальными дисковыми массивами и S3-совместимыми объектными хранилищами;
— Опыт нагрузочного тестирования ClickHouse и MariaDB;
— Опыт построения процедур disaster recovery;
— Опыт подготовки архитектурных и эксплуатационных документов для заказчиков;
— Опыт работы с ProxySQL, MaxScale, HAProxy, Keepalived, Pacemaker / Corosync или аналогичными решениями;
— Опыт проведения регламентных работ с минимальным downtime;
— Опыт аудита продуктивных инсталляций у заказчиков.
Условия:
— Постоянная занятость;
— Работа с продуктивной, тестовой и лабораторной инфраструктурой;
— Взаимодействие с командой эксплуатации, инженерами SIEM, разработчиками, архитекторами и техническими представителями заказчика;
— Участие в планировании изменений, разборе инцидентов и развитии архитектуры хранения данных.
Задачи:
— Разработка и поддержка инфраструктуры проектов в Timeweb Cloud.
— Развитие Infrastructure as Code с использованием OpenTofu / Terraform.
— Разработка и поддержка Ansible-ролей и playbook'ов.
— Настройка и поддержка Docker / Docker Compose окружений.
— Разработка и поддержка GitLab CI/CD пайплайнов для инфраструктуры и приложений.
— Настройка сетевой инфраструктуры: VPC, NAT, firewall, reverse proxy, DNS, SSL/TLS.
— Поддержка stage и production окружений.
— Настройка и развитие мониторинга, логирования и алертинга на базе Prometheus, Grafana и Loki.
— Участие в расследовании инфраструктурных проблем и инцидентов.
— Автоматизация инфраструктурных и эксплуатационных задач.
Требования:
— Уверенное знание Linux.
— Опыт работы с Docker и Docker Compose.
— Опыт работы с Terraform / OpenTofu или другими IaC-инструментами.
— Опыт работы с Ansible.
— Опыт построения и поддержки CI/CD пайплайнов.
— Понимание сетей: TCP/IP, DNS, HTTP/HTTPS, NAT, firewall.
— Опыт работы с nginx, Angie, Traefik или другими reverse proxy.
— Понимание принципов работы PostgreSQL, Redis и других типичных сервисов веб-приложений на инфраструктурном уровне.
— Опыт работы с Git.
Будет плюсом:
— Опыт работы с Timeweb Cloud или другими облачными провайдерами.
— Опыт работы с GitLab CI/CD и self-hosted GitLab.
— Опыт работы с Prometheus, Grafana, Loki, Grafana Alloy.
— Опыт работы с Nexus или другими registry/repository manager'ами.
— Опыт построения инфраструктуры для PHP, Node.js или Go-приложений.
— Опыт работы с RabbitMQ, Centrifugo и другими инфраструктурными компонентами веб-приложений.
— Опыт настройки security-проверок инфраструктурного кода: Checkov, Gitleaks, Trivy и аналоги.
— Опыт работы с Kubernetes.
Удалённо
Зарплата не указана
Не хотите искать каждый день?
Настройте подбор один раз, и подходящие вакансии будут сами приходить в Telegram.
Требуется DevOps инженер с опытом 3-5 лет для работы в офисе в Тбилиси над мобильным приложением.
Требования:
— Опыт 3-5 лет
— Kubernetes (k8s)
— AWS
— Argo CD
— Terraform
— Grafana
— Уверенное владение нейросетями
— Опыт работы с AI-агентами
Условия:
— Полная занятость
— Фиксированная зарплата на руки от 2500 до 3000
Задачи:
- Проектирование и разработка высоконагруженных микросервисных систем с нуля (архитектура, выбор стека, декомпозиция).
- Развитие существующего функционала: рефакторинг, оптимизация узких мест, миграция данных.
- Интеграция и контрактное взаимодействие: разработка и документирование API (REST/AsyncAPI/gRPC), обеспечение бесшовного взаимодействия между десятками сервисов.
- Code Review и менторство: повышение качества кода в команде, внедрение best practices.
- Работа с инфраструктурой: участие в настройке CI/CD, оптимизация Docker-образов, взаимодействие с оркестрацией (Kubernetes/Swarm).
Требования:
- Опыт коммерческой разработки на Python от 4 лет (в идеале от 5 лет), участие в полном жизненном цикле крупных проектов.
- Глубокое понимание асинхронности: работа event loop, конкурентность, параллелизм, специфика GIL.
- Уверенное знание FastAPI, асинхронного SQLAlchemy, Pydantic.
- Экспертный уровень работы с СУБД: написание и оптимизация сложных запросов (EXPLAIN, индексы, партиционирование), проектирование схем данных с учетом нагрузок.
- Опыт построения Event-Driven Architecture поверх RabbitMQ или Kafka, понимание гарантий доставки (at-least-once, exactly-once), работа с DLQ.
- Инфраструктурный кругозор: уверенная работа с Linux (bash, сеть, процессы), опыт контейнеризации (Docker).
- Архитектурное мышление: понимание SOLID, паттернов микросервисной архитектуры (API Gateway, Circuit Breaker, Saga), умение аргументировать технологический выбор.
Будет плюсом:
- Опыт в финтехе или высоконагруженных проектах.
- Навыки настройки мониторинга и логирования (Prometheus, Grafana, ELK).
Условия:
- Оформление по договору ГПХ или ИП (РФ) с компенсацией налога.
- Оплачиваемые отпуска и больничные.
- Горизонтальная культура управления и отсутствие микроменеджмента.
- В процессе отбора предусмотрено небольшое неоплачиваемое тестовое задание.
Задачи:
— Развивать и администрировать стек сбора метрик Grafana, Graphite, VictoriaMetrics, Moira.
— Повышать отказоустойчивость и масштабируемость системы.
— Разворачивать и поддерживать решения в Kubernetes, писать и дорабатывать Helm-чарты.
— Осуществлять миграции, обновлять систему.
— Разбираться с инцидентами и их причинами.
— Взаимодействовать с командами разработки по вопросам наблюдаемости сервисов.
Требования:
— Опыт администрирования Linux от двух лет: управление сервисами, настройка окружения, работа по SSH.
— Практический опыт работы с Kubernetes: понимание манифестов и написание Helm-чартов.
— Опыт построения CI/CD пайплайнов.
— Опыт администрирования систем телеметрии: Grafana, VictoriaMetrics, Sentry, Kibana.
— Знание Ansible: написание ролей и плейбуков для автоматизации развертывания.
— Уверенная работа с Git.
— Понимание принципов отказоустойчивости распределенных систем.
— Навыки дебага приложений и инфраструктуры по логам и метрикам.
Задачи:
— Решать технические проблемы клиентов от начала до конца (Helpdesk + Slack) в рамках SLA
— Проводить анализ корневых причин с использованием Grafana, Datadog (логи, метрики, трассировки)
— Создавать дашборды мониторинга и проактивные оповещения
— Писать скрипты на Python для автоматизации и массовых операций
— Активно использовать AI-инструменты (Claude, Cursor, ChatGPT) для ускорения устранения проблем
Требования:
— Опыт ежедневной работы с LLM и prompt engineering
— Практические навыки работы с Grafana/Datadog (создание дашбордов и оповещений)
— Скриптинг на Python и хорошее понимание распределённых систем
— Опыт работы 2+ года в TechOps/технической поддержке (FinTech/Forex/Crypto будет плюсом)
— Отличное владение английским языком (C1+)
Условия:
— Удалённая работа, предпочтительно в часовом поясе GMT+5 - GMT+8
— Работа в англоязычной команде
Задачи:
— Обслуживание и обновление LMS: управление получением пакетов обновлений и их применение к системе LMS, загрузка контейнерных образов и их отправка во внутренний Docker регистр.
— Управление инфраструктурой: локальное развертывание и конфигурация инфраструктуры, выполнение развертывания и настройки кластеров Kubernetes, обслуживание базы данных на выделенном инстансе отдельно от кластера Kubernetes, установка и мониторинг автоматического резервного копирования БД с периодичностью каждые 24 часа.
— Хранилище и пайплайны развертывания: управление доступом к объектным хранилищам (AWS S3 или аналогичным), получение пакетов из назначенных источников и управление их загрузкой в объектное хранилище.
Требования:
— Облачные платформы и инфраструктура: AWS, GCP, Azure; экспертный опыт работы с Docker и Kubernetes (развертывание, конфигурация и оркестрация); уверенное владение подходом Infrastructure as Code (Terraform, Ansible).
— CI/CD и автоматизация: опыт проектирования и поддержки пайплайнов CI/CD (Jenkins, GitLab CI/CD).
— Программирование и скрипты: уверенное владение Python и Go (Golang); навыки написания скриптов на Bash/Shell для автоматизации.
— Мониторинг и Observability: опыт развертывания и управления инструментами мониторинга (Prometheus, Grafana, Zabbix, ELK Stack: ElasticSearch/Kibana).
— Операционные системы: глубокие знания операционных систем на базе Linux (NixOS, Ubuntu Core).
— Понимание микросервисной архитектуры и распределенных систем.
— Знание методологий Agile, стандартов ITIL и процессов управления инцидентами.
— Опыт работы с высоконагруженными средами и проведения аудита инфраструктуры.
Условия:
— Заработная плата обсуждается по результатам собеседования и зависит от навыков кандидата.
— Формат работы — офис (удалёнка не предусмотрена, специфика проекта).
— Москва, Зеленоград, Казань.
— Работа над технологически сложным продуктом на стыке Computer Vision и мобильной разработки.
— Возможности для профессионального роста и влияния на процессы.
Задачи:
— Разворачивать и обслуживать Kubernetes-кластеры (OpenShift, BareMetal).
— Строить и поддерживать CI/CD-пайплайны (GitLab CI, Jenkins, TeamCity) от коммита до прода.
— Администрировать с-системы, виртуализацию и сети.
— Работать с инфраструктурным стеком: Docker, Ansible, PostgreSQL, Kafka/RabbitMQ, Vault.
— Настраивать и развивать системы мониторинга (Prometheus, Grafana) и логирования (ELK).
— Автоматизировать рутину на Bash/Python.
Требования:
— Официальный опыт работы в роли DevOps от 3 лет.
— Понимание специфики жизненного цикла AI-агентов или ML-моделей.
— Практический опыт разработки и развертывания автономных AI-агентов с использованием базового окружения (MCP, RAG).
— Опыт работы с Kubernetes (установка, обновление, управление).
— Практические навыки по настройке CI/CD, сборке артефактов (Harbor, Nexus).
— Глубокое понимание Linux, сетей, балансировки (Nginx/Haproxy).
— Знание принципов работы контейнеров, СУБД, брокеров сообщений.
Условия:
— Работа в офисе Москвы (удаленки и гибрида нет).
— Работа в стабильной компании, "белая" заработная плата.
— Оформление в соответствии с ТК РФ с первого дня работы.
— Расширенный социальный пакет: ДМС (включая стоматологию), корпоративные скидки на посещение фитнес-клубов, футбольная и волейбольная секции.
— Профессиональное обучение и развитие.
— Снабжение всей необходимой современной техникой: мощный ноутбук привезут прямо в день оформления.
Задачи:
— Разработка и поддержка backend-сервисов на Python (REST API / gRPC)
— Проектирование и оптимизация схем баз данных (PostgreSQL/MySQL), написание и оптимизация SQL-запросов
— Работа с очередями сообщений (Kafka, RabbitMQ, Redis)
— Написание unit- и интеграционных тестов, поддержка покрытия кода тестами
— Код-ревью коллег, участие в обсуждении архитектурных решений
— Взаимодействие с DevOps по вопросам CI/CD, деплоя и мониторинга сервисов
— Диагностика и устранение проблем production (логи, метрики, трассировка)
— Написание технической документации (API-спецификации, README, ADR)
Требования:
— Опыт коммерческой разработки на Python от 2–3 лет
— Уверенное знание одного из фреймворков: Django / FastAPI / Flask
— Опыт работы с реляционными БД (PostgreSQL предпочтительно), понимание индексов, транзакций, нормализации
— Знание принципов проектирования REST API, опыт работы с OpenAPI/Swagger
— Опыт работы с Git, понимание Git flow
— Знание основ Docker, опыт работы в контейнеризированной среде
— Понимание принципов асинхронного программирования (asyncio, async/await)
— Базовые знания в области безопасности бэкенда (валидация данных, аутентификация/авторизация — JWT, OAuth2)
Будет плюсом:
— Опыт работы с очередями сообщений (Kafka, RabbitMQ)
— Опыт работы с CI/CD (GitLab CI, GitHub Actions, Jenkins)
— Знание Redis/Memcached для кэширования
— Опыт работы с микросервисной архитектурой
— Опыт написания CDC-пайплайнов / работы с Debezium
— Опыт работы с системами мониторинга (Prometheus, Grafana, Sentry)
— Английский язык на уровне чтения технической документации
Условия:
— Конкурентная заработная плата (готовы отталкиваться от ваших ожиданий)
— Оформление по ИП
— Полностью удаленный формат работы или возможность работать в офисах в Казани
— ДМС после 3-х месяцев работы
— 2 Day-off и премии к значимым событиям
— Корпоративные мероприятия
— Отсутствие формализма и бюрократии
— Поддержка в развитии: внутреннее и внешнее обучение, тренинги и корпоративные поездки для лучших сотрудников
Задачи:
— Разработка серверной части системы на Java / Kotlin Spring, PostgreSQL, OpenSearch, Keycloak и др.;
— Оптимизация и рефакторинг существующих сервисов и компонентов с использованием новых релевантных фреймворков;
— Участие в техническом развитии проекта, проектировании новых сервисов.
Требования:
— Продвинутое владение Git (git flow, feature branches, rebase), Gradle;
— Глубокое понимание внутренностей Java и Spring;
— Умение проектировать и разрабатывать расширяемые API для взаимодействия сервисов системы между собой и со смежными системами;
— Опыт работы с PostgreSQL, MinIO, Apache Tomcat, Nginx, Keycloak, Docker, Docker compose;
— Будет преимуществом опыт работы с Apache Superset, Grails, Micronaut, OpenSearch, Groovy, Matomo, Grafana;
— Знание и практическое применение принципов SOLID для устранения устаревшего кода и создания масштабируемых систем;
— Опыт написания автотестов;
— Английский язык: уровень B1 или выше для чтения технической документации.
Условия:
— Оформление по ТК РФ, "белая" заработная плата;
— График 5/2, пн-чт с 9:00 до 18:00, пт с 9:00 до 16:45;
— ДМС;
— Компенсация расходов на абонемент в фитнес-клуб, бассейн и др.;
— Комфортный офис в 2 минутах от м.Сокол.
Миссия:
Мы разрабатываем экосистему для Медси - мобильное приложение SmartMed, сервис для врачей, MDM систему хранения информации. Цель — сделать удобные сервисы для улучшения коммуникации между людьми и бизнесом через компьютер и телефон.
Задачи:
— Администрировать, мониторить и обеспечивать бесперебойную работу инфраструктуры;
— Устранять нештатные ситуации и анализировать причины их возникновения;
— Поддерживать и развивать CI/CD;
— Развивать продукт в сторону устойчивости и масштабируемости;
— Не бояться быть собой и делиться экспертизой.
Требования:
— Опыт администрирования Linux-серверов;
— Опыт и глубокое понимание построения CI/CD;
— Опыт работы с инструментами мониторинга и логирования (Prometheus, Grafana).
Условия:
— Возможность создавать передовые продукты в медицинской сфере;
— Работа в крупнейшем медицинском холдинге;
— Оформление по ТК РФ;
— Индивидуальные условия по страховке (ДМС) в клиниках Медси;
— Компенсация профессиональной литературы, курсов, обучения, участия в конференциях и семинарах;
— Пятидневный график работы, гибкое начало рабочего дня.
Задачи:
— Разработка сервисов ИИ платформы для создания функциональных агентов и ИИ ассистентов.
— Подготовка бэк части для функциональных агентов, включая среду разработки агентов: тестирование фреймворков, opensource агенты.
— Разработка сервиса управления реестром и скиллами агентов.
— Создание отдельного единого сервиса для всех баз знаний, интеграция крупных корпоративных источников.
Требования:
— Понимание архитектуры, возможностей и ограничений современных языковых моделей.
— Опыт работы с embeddings, vector search, RAG, structured output и tool calling.
— Понимание принципов проектирования AI-агентов: управление состоянием и контекстом, выбор инструментов, контроль уровня автономности и human-in-the-loop.
— Опыт построения evals для LLM-систем, оценки качества ответов, контроля галлюцинаций и мониторинга поведения системы.
— Понимание рисков prompt injection, некорректного tool calling, утечки данных и чрезмерных прав доступа агента.
— Опыт работы с API языковых моделей, Hugging Face и одним из orchestration-фреймворков.
— Умение оценивать стоимость, latency и масштабируемость LLM-решений.
— Опыт работы в e-commerce, retail или других продуктовых highload-системах.
— Опыт работы с Airflow, MLflow, Kafka, Redis, Kubernetes, Prometheus и Grafana.
— Опыт эксплуатации GPU-инфраструктуры и оптимизации inference.
— Опыт fine-tuning или адаптации LLM, включая LoRA / PEFT.
— Опыт проектирования agentic workflows или multi-agent-систем.
— Понимание принципов информационной безопасности, privacy и работы с персональными данными.
Условия:
— full-time
Вакансия предполагает работу на позиции Senior Data Science специалиста с полной занятостью и удалённым форматом в России. Основные задачи включают разработку сервисов для ИИ платформы, предназначенной для создания функциональных агентов и ИИ ассистентов, а также подготовку серверной части для таких агентов, включая тестирование фреймворков и работу с opensource агентами. В обязанности также входит создание сервиса управления реестром и навыками агентов, а также разработка единого сервиса для баз знаний с интеграцией крупных корпоративных источников. Кандидат должен хорошо разбираться в архитектуре и ограничениях современных языковых моделей, иметь опыт работы с embeddings, vector search, RAG, structured output и tool calling. Важны знания принципов проектирования AI-агентов, включая управление состоянием и контекстом, выбор инструментов, контроль автономности и human-in-the-loop. Требуется опыт построения evals для LLM-систем, оценки качества ответов, контроля галлюцинаций и мониторинга поведения, а также понимание рисков, связанных с prompt injection, некорректным tool calling, утечкой данных и избыточными правами доступа. Необходим опыт работы с API языковых моделей, Hugging Face и одним из orchestration-фреймворков, умение оценивать стоимость, задержки и масштабируемость LLM-решений. Желателен опыт в e-commerce, retail или других высоконагруженных продуктовых системах, а также владение инструментами Airflow, MLflow, Kafka, Redis, Kubernetes, Prometheus и Grafana. Кандидат должен иметь опыт эксплуатации GPU-инфраструктуры и оптимизации inference, а также fine-tuning или адаптации LLM, включая LoRA/PEFT. Опыт проектирования agentic workflows или multi-agent систем и понимание принципов информационной безопасности, конфиденциальности и работы с персональными данными также обязательны.
Задачи:
— Архитектура, создание и поддержка инструментов самообслуживания платформы и порталов разработчиков, позволяющих командам самостоятельно обеспечивать инфраструктуру, управлять окружениями и развёртывать сервисы.
— Поддержка автоматизированных GitOps пайплайнов доставки с использованием ArgoCD/Flux, внедрение безопасных практик деплоя (canary, blue-green, автоматические откаты).
— Поддержка здоровья кластеров, жизненных циклов обновлений, политик автоскейлинга и безопасности в мульти-региональных Kubernetes-развёртываниях.
— Написание production-кода на Go/Python для создания кастомных Kubernetes операторов, CLI-утилит и API-автоматизации для оптимизации рабочих процессов разработчиков.
— Внедрение платформенных SLI/SLO, централизованного логирования и трассировки, а также автоматизация политик безопасности и контроля затрат.
Требования:
— Опыт 5+ лет в platform engineering, site reliability engineering (SRE) или core DevOps с подтверждённым опытом проектирования и внедрения Internal Developer Platforms (IDP).
— Экспертное владение Kubernetes, архитектурами кастомных контроллеров/операторов, сервис-мешами (Istio/Linkerd), непрерывной доставкой через GitOps инструменты (ArgoCD или Flux).
— Глубокие знания Terraform, OpenTofu или Pulumi для создания модульных инфраструктурных шаблонов в облаках (AWS, GCP, Azure).
— Сильные навыки программирования на Go или Python для создания расширений платформы, CLI-инструментов, Kubernetes операторов и интеграций API.
— Практический опыт создания или интеграции порталов разработчиков (Backstage, Port) и автоматизированных workflow движков.
— Опыт настройки телеметрии с Prometheus, Grafana и OpenTelemetry для метрик, логов и трассировок.
Желательно:
— Опыт с cloud-native control plane абстракциями, например Crossplane.
— Знания FinOps, мониторинга затрат контейнеров (Kubecost) и автоматической оптимизации ресурсов.
— Активное участие в open-source проектах CNCF.
— Опыт в zero-trust безопасности, управлении секретами (HashiCorp Vault) и автоматизации комплаенса.
Условия:
— Своевременные ежемесячные выплаты с гибкими опциями вывода.
— Предсказуемый график работы: 8-часовой рабочий день.
— До 24 оплачиваемых гибких дней отпуска в год для full-time позиций.
— Долгосрочные удалённые позиции в передовых компаниях.
— Персонально подобранные вакансии без типичных рекрутинговых барьеров.
— Единый процесс контрактации для множества возможностей без дополнительных оценок.
— Стабильная оплата каждый месяц при работе через Proxify.
Задачи:
- Определять и поддерживать SLO, SLI и error budgets, а также обеспечивать наблюдаемость (метрики, логи, трассировки, оповещения) для своевременного обнаружения регрессий.
- Создавать повторяемую, самообслуживаемую инфраструктуру с помощью инфраструктуры как кода, CI/CD и золотых путей.
- Полностью управлять процессом развертывания: прогрессивная доставка, канареечные релизы, безопасные миграции и откаты.
- Эксплуатировать системы, обеспечивающие работу узлов, валидаторов, RPC и индексирования Somnia, оптимизируя производительность и затраты в разных регионах.
- Руководить реагированием на инциденты и дежурствами, проводить безвиновные постмортемы, постоянно укреплять платформу.
- Сотрудничать с командами продукта и протокола для проектирования и эксплуатации готовых к производству сервисов.
Требования:
- Опыт эксплуатации производственной инфраструктуры в масштабе (облако и/или bare metal) с глубокими знаниями Linux.
- Опыт работы с инфраструктурой как кодом, например Terraform или Pulumi, а также с системами управления конфигурациями.
- Опыт эксплуатации контейнеров и оркестрационных платформ (Docker, Kubernetes) в продакшене.
- Сильные навыки программирования, желательно на Go и/или TypeScript, для создания автоматизации и внутренних инструментов.
- Опыт работы с системами наблюдаемости (Prometheus, Grafana, OpenTelemetry или аналогами).
- Опыт эксплуатации и мониторинга распределённых систем, включая планирование ёмкости и оптимизацию производительности.
- Искренний интерес к криптовалютам и on-chain системам.
Будет плюсом: опыт эксплуатации инфраструктуры блокчейн-узлов (валидаторы, RPC, архивные узлы); опыт высокопроизводительных сетей или балансировки нагрузки в масштабе; мульти-региональные развертывания с отказоустойчивостью; безопасность и управление ключами (HSM, управление секретами).
Задачи:
— Эксплуатация и развитие мультиоблачной инфраструктуры (DigitalOcean, AWS, Hetzner, Kubernetes);
— Сопровождение GitOps и CI/CD (ArgoCD, Flux, Helm, GitLab CI), релизы и миграции между средами (dev/stage/preprod/prod);
— Мониторинг и observability (VictoriaMetrics, Grafana, Loki), настройка on-call алертов;
— Управление секретами, доступами и сетевой инфраструктурой (Vault, NetBird/WireGuard, Cloudflare, CoreDNS);
— Реагирование на инциденты — диагностика, пост-мортемы, перевод ручных фиксов в IaC;
— Взаимодействие с командами разработки (Go, PHP, Node.js) по CI, конфигурациям и дебагу.
Требования:
— Опыт от 3 лет в DevOps / SRE / Platform Engineering в финтехе, платёжных сервисах (PSP), крипто/блокчейн-проектах или других high-load продуктах со сложной распределённой инфраструктурой;
— Уверенный Kubernetes (деплой, ingress, HPA/PDB, RBAC, траблшутинг) и Terraform на реальных облачных ресурсах;
— Опыт построения CI/CD-пайплайнов (GitLab CI, Docker), GitOps (ArgoCD/Flux) и Helm;
— Крепкий Linux и сетевой дебаг (DNS, TLS, NAT, маршрутизация);
— Опыт со стеком мониторинга и логирования (Grafana/Prometheus/VictoriaMetrics, Loki/ELK) и управлением секретами (Vault);
— Умение читать код на Go/PHP/JS для диагностики падений сервисов;
— Английский — уверенное чтение технической документации и логов;
— Системный подход к решению проблем — умение докопаться до сути инцидента, ответственность за uptime, автономность, способность переводить ручные «костыли» в durable-решения.
Плюсом:
— опыт с AWS/DO, администрирование БД (PostgreSQL, Redis, Kafka), эксплуатация blockchain-нод.
Условия:
— Полностью удаленный формат работы;
— Базовый график 5/2 с 10:00 до 19:00 по мск;
— Присутствует on-call (реагирование на срабатывание алертов), график дежурств обсуждается индивидуально;
— Оплачиваемый отпуск — 28 дней + 10 дополнительных day-off в году;
— Заработная плата до 200 000 ₽ на старте и до 250 000 ₽ после ИС (обсуждается индивидуально);
— Испытательный срок — 3 месяца;
— Интересные проекты;
— Реальные возможности для профессионального роста внутри компании.
Задачи:
— Разрабатывать новую функциональность на базе 1C: Управление МФО и КПК и БИТ.ФИНАНС.МСФО в условиях высоконагруженной информационной базы
— Оптимизировать и поддерживать функциональность в условиях большой кодовой базы
— Писать код в 1C: Enterprise Development Tools
— Выпускать релизы по регламентированному пайплайну, пользоваться Git/GitLab
— Проходить код-ревью своих Merge Request’ов и код-ревью запросов коллег
— Участвовать в командном Task Grooming и вместе с программистами 1C и Golang находить удачные архитектурные решения
— Работать по гибким методологиям вместе с командой (Scrum)
Требования:
— Опыт работы разработчиком 1C не менее 6 лет
— Опыт написания кода в IDE 1C: Enterprise Development Tools
— Знание Git
— Умение решать интеграционные задачи с различными сервисами и другими продуктами 1C (например, HTTP и асинхронный обмен по шине данных)
— Опыт работы с клиент-серверной архитектурой на управляемых формах
— Знание базовых механизмов 1С: БСП
— Глубокое знание работы платформы 1С:Предприятие 8.3
— Опыт разработки решений в многопоточной параллельной обработке данных
— Умение и готовность работать в команде
Будет плюсом:
— Опыт работы с 1С: Управление МФО и КПК
— Опыт работы в компаниях, связанных с финансами, в идеале — с кредитами и займами юридическим и физическим лицам
— Сертификация и аттестация по платформе 1C: Предприятие 8
— Обучение или сертификат по 1С:Эксперт по технологическим вопросам
Условия:
— Работа в команде Банка Ozon, создающей и развивающей сервисы для покупателей и продавцов
— Использование передовых технологий и микросервисной архитектуры
— Работа с процессингом, учётным ядром, финансовым мониторингом, переводами через Систему быстрых платежей
— Разработка продуктов: виртуальная и пластиковая карта, рассрочка, банк для юридических лиц, программы финансирования продавцов
Стек технологий:
— Основной язык: 1C (1C:EDT + Strict Type)
— Дополнительно: Go, Python, C++
— Тестируемость: YaxUnit, Vanessa, E2E на Python
— Хранение / обмен: Kafka, ClickHouse, MS SQL (для 1С), S3 (CEPH), Nginx, Vertica, PostgreSQL (для Go)
— CI / CD: Kubernetes, Docker, Vault, Keycloak, GitLab + Git
— Наблюдаемость: Prometheus, Thanos, Grafana, Alert registry (на Prometheus Rules), ЦКК, 1SMonitor
— Безопасность: Vault, Keycloak, Kerberos, AD, splunk, LDAP
— Трекер задач: Jira
— Документация: Confluence, Holst, PlantUML
— Управление проектами: Квартальное планирование, Scrum poker planning