Старший BI-разработчик в команду FinTech
В работе мы ставим амбициозные цели и не останавливаемся на достигнутом. Поэтому для нас так важно, чтобы каждый участник большой команды Авито разделял культуру компании. Погрузиться в неё помогает Манифест, в котором собраны наши основные ориентиры — миссия, ценности, принципы работы manifesto.avito.com
О команде
Ищем опытного BI-разработчика для развития инфраструктуры скоринга в Финтехе Авито. Специалист будет отвечать за построение и поддержку пайплайнов для риск- и ML-моделей, качество и доступность фичей, а также за понятную и надёжную отчётность по ключевым метрикам риск-блока.
У нас открыта вакансия инженерного специалиста, который будет представлять функции данных, BI и MLE в кластере FinTech, вести инфраструктурные и продуктовые инициативы в скоринге, обеспечивать работу моделей на больших данных с высокими требованиями к скорости и стабильности, а также развивать витрины, отчётность и мониторинг.
Вам предстоит решать открытые задачи в высоком темпе: взаимодействовать с разработкой, продуктом, рисками, партнёрами и внутренней отчётностью, проектировать и оптимизировать пайплайны данных и фичей для продакшен-моделей, строить систему метрик, мониторингов и алертинга, управлять ожиданиями заинтересованных сторон и улучшать качество и производительность решений.
Примеры будущих задач:
— проектировать и внедрять сквозные пайплайны для риск- и ML-моделей от сырых источников и внешних партнёров до продакшен-фичей и скоринговых решений с учётом требований к задержке и отказоустойчивости;
— разрабатывать и оптимизировать витрины, в том числе для Feature Store, под скоринговые сценарии:
— исследовать фичи;
— профилировать и оптимизировать запросы;
— работать с перекосом данных и узкими местами в производительности;
— настраивать мониторинг качества данных и фичей: пропусков, дрейфа и задержек, создавать чекеры и алерты для раннего выявления проблем в продакшене моделей;
— строить отчётность и дашборды в BI-системах для отслеживания ключевых риск- и продуктовых метрик, загрузки пайплайнов, SLA и SLO. Мы используем Redash;
— исследовать и внедрять улучшения в архитектуру data- и ML-инфраструктуры: оптимизировать стоимость, ускорять пайплайны, переходить на новые сервисные и хранилищные решения совместно с командами платформ;
— взаимодействовать с внешними партнёрами по обмену данными: формировать и согласовывать технические требования к интеграциям, участвовать в тестировании, настраивать проверки качества и стабильности поставок.
Мы ждём, что вы:
— уверенно владеете SQL и умеете работать с большими массивами данных: писать и оптимизировать сложные запросы, строить эффективные витрины и представления под аналитические и скоринговые нагрузки;
— уверенно используете Python для работы с данными и инфраструктурой: обработки и валидации данных, написания утилит и сервисных скриптов, интеграции с ML-пайплайнами;
— имеете опыт построения и сопровождения data-, ETL- и ELT-пайплайнов в продакшене, понимаете вопросы оркестрации, версионирования, отказоустойчивости и наблюдаемости;
— работали с BI-инструментами: умеете проектировать метрики, собирать дашборды, оптимизировать источники и предоставлять бизнесу понятные и надёжные отчёты;
— понимаете требования продакшен-среды: умеете работать с ограничениями по задержке и ресурсам, следить за SLA, находить и устранять узкие места в производительности;
— умеете формулировать и приоритизировать задачи, управлять бэклогом и ожиданиями заинтересованных сторон, работать в условиях быстрого изменения приоритетов.
Будет здорово, если вы:
— имеете опыт работы с кластерными СУБД и распределёнными движками: Trino, Vertica, ClickHouse и другими, а также понимаете принципы их оптимизации;
— работали в риск- или финтех-домене: понимаете специфику скоринга, кредитных рисков, транзакционных данных и регуляторных требований;
— понимаете основы ML и жизненный цикл моделей: можете вместе с дата-сайентистами проектировать фичи, поддерживать их консистентность в офлайне и онлайне, настраивать мониторинг дрейфа и деградации;
— участвовали во взаимодействии с внешними поставщиками данных или партнёрами: согласовывали и реализовывали технические интеграции, контролировали качество и полноту данных.
Работа у нас — это:
— возможность влиять на бизнес и развитие продукта;
— интересные и разнообразные задачи: аналитики в Авито ищут точки роста бизнеса, изучают поведение пользователей, придумывают фреймворки и настраивают дашборды;
— много качественных данных, мощная инфраструктура и инструменты, любое необходимое железо — всё готово для продуктивной работы;
— талантливая команда, крутая аналитическая культура и сообщество профессионалов;
— прозрачная система премий, достойная зарплата — размер обсудим на собеседовании;
— личный бюджет на обучение, который можно тратить на книги, курсы и конференции;
— забота о здоровье: с первого дня у вас будет ДМС со стоматологией, в офисе принимают терапевт и массажист;
— удалёнка и замечательный офис в двух минутах от метро «Белорусская»: панорамный вид центр города, места для уединённой работы и зоны отдыха.