Задачи:
— обработка Excel, PDF и сканов;
— извлечение и нормализация данных;
— сопоставление данных и поиск расхождений;
— интеграция OCR и Document AI;
— использование LLM для интерпретации данных;
— разработка backend/API;
— участие в архитектуре MVP;
— работа с обезличенными финансовыми документами.
Требования:
— Python от 3 лет;
— pandas, Excel/CSV;
— парсинг PDF;
— backend и REST API;
— алгоритмы matching, нормализации и очистки данных;
— Git;
— умение самостоятельно проектировать решения.
Будет плюсом: OCR, PyMuPDF, pdfplumber, Camelot, Tabula, fuzzy matching, Document AI, OpenAI/Azure OpenAI/YandexGPT, reconciliation, On-Premise.
Контакты работодателя доступны по кнопке «Откликнуться» после входа.