Мы развиваем продукт DataQuality - систему мониторинга качества данных, которая в реальном времени следит за потоком событий антифрод-платформы: согласованность полей, заполненность расчетов, стабильность скорингов и агрегатов, статистику срабатывания фрод-правил, пропажу типов событий.
Мы ищем аналитика данных, который возьмет на себя две связанные задачи: довести систему алертов до состояния, когда сигналов мало, но каждый по делу, и исследовать связанные с данными обращения пользователей антифрод-платформы, находя в них подсказки о том, что мы еще не умеем мониторить.
Это техническая роль. Поток платформы - тысячи событий в секунду, история в Hadoop - миллиарды строк. Поэтому нужно понимать, как Spark исполняет ваш запрос, и уверенно владеть статистикой: пороги алертов выводятся из распределений, а не подбираются на глаз.
Роль хорошо подойдет тем, кто работал с ML (обучал и оценивал модели, искал аномалии, следил за дрейфом признаков), но не хочет уходить в Data Science или MLOps. У нас статистика и ML-подходы применяются к прикладной задаче с быстрым результатом: настроенная вами проверка уже завтра ловит реальный инцидент на боевом потоке.
Будет плюсом: