Платформа проверки цифровой личности, оценки рисков и предотвращения мошенничества
Задачи:
- Развивать NLP-пайплайны для извлечения сущностей из санкционных списков и других источников;
- Улучшать сопоставление имён и разрешение идентичностей с учётом алиасов и многоязычных данных;
- Масштабировать движок сопоставления и модели оценки риска для проверки клиентов в реальном времени;
- Создавать тестовые наборы и метрики качества моделей для AML-скрининга.
Требования:
- 7+ лет в Data Science или ML с опытом NLP, entity resolution либо извлечения информации;
- Практический опыт промышленного внедрения NER и NLP-пайплайнов для сопоставления записей;
- Python и ML-библиотеки PyTorch, spaCy или HuggingFace Transformers;
- Уверенный SQL и опыт работы с крупными дата-пайплайнами и production ML.