Задачи:
— Проектировать и развивать LLM/AI-системы и AI-агентов;
— Строить многошаговые agentic workflows: routing, tool calling, state management;
— Работать с Prompt Engineering и Context Engineering;
— Управлять контекстом, памятью и состоянием диалога;
— Реализовывать structured output и function/tool calling;
— Строить RAG-пайплайны: chunking, embeddings, retrieval, reranking;
— Интегрировать LLM с API, базами данных и внутренними сервисами;
— Разрабатывать backend-сервисы на Go и AI-компоненты на Python;
— Исследовать новые модели и подходы, быстро проверять гипотезы;
— Выбирать модели с учетом качества, latency и стоимости;
— Строить систему оценки качества: evals, regression tests, golden datasets, LLM-as-a-judge;
— Анализировать логи и traces, улучшать качество и стабильность агентов;
— Реализовывать retries, fallbacks, timeouts и обработку ошибок;
— Доводить решения от прототипа до стабильного production.
Требования:
Go:
— production-сервисы;
— REST/gRPC API;
— concurrency;
— работа с БД;
— микросервисная архитектура.
Python:
— AI-сервисы и backend;
— async;
— API;
— обработка данных;
— быстрое прототипирование.
Также важно:
— Практический опыт разработки production-приложений с LLM;
— Понимание архитектуры современных AI-систем: prompt → context → tools → agent → state → evaluation;
— Опыт Prompt Engineering: system prompts, few-shot, prompt chaining, structured output;
— Опыт Context Engineering: memory, summarization, динамическая сборка контекста;
— Опыт создания AI-агентов и agentic workflows;
— Работа с LLM API и понимание особенностей разных моделей;
— Понимание RAG: embeddings, vector search, retrieval, reranking, hybrid search;
— Понимание evals, regression testing и анализа production-логов;
— Опыт с PostgreSQL, MongoDB, Redis, Docker, Git, CI/CD;
— Понимание production-подходов: observability, scalability, latency, retries, fallbacks и контроль стоимости.
Контакты работодателя доступны по кнопке «Откликнуться» после входа.