Инженер данных в команду UGC Поиска
Яндекс (Поисковый портал) Инженер данных в команду UGC Поиска
Ежедневно миллионы пользователей приходят в Яндекс Поиск, чтобы решить свои задачи: купить товар, выбрать фильм, найти врача и многие другие. Важную роль в процессе выбора играют отзывы. Мы занимаемся подготовкой инфраструктуры для сбора отзывов и их обработки, чтобы помочь пользователям сэкономить время и упростить принятие решения.
Ищем дата-инженера или бэкендера, знающего SQL и Python, классические алгоритмы и структуры данных.
Какие задачи вас ждут
Сбор отзывов от пользователей
Наша основная задача — поделиться с пользователями Яндекса реальным опытом реальных людей. Для этого нужно находить пользователей, готовых оставить свой отзыв о товарах и услугах, а также нужно доносить опросы до разных площадок Поиска.
Показ агрегированного опыта пользователей
Для отображения отзывов используется множество эвристик и моделей: подсчёт рейтингов и их динамики, ранжирование отзывов, выделение важных аспектов в отзывах, модерация контента. Полученные данные нужно донести до пользователей и других сервисов Яндекса.
Аналитика
В ходе работы потребуется внедрять метрики и мониторинги качества, обрабатывать и анализировать Big Data, предлагать идеи для улучшения продуктов.
Больше о разработке в Яндексе — в канале Yandex for Developers
Мы ждём, что вы
- Работали в роли старшего разработчика, дата‑инженера или тимлида больше трёх лет
- Владеете инструментами и технологиями работы с большими данными, например Hadoop, Spark, SQL, Python
- Знакомы с C++
- Нацелены на результат и готовы отвечать за влияние своих решений на работу продукта
Будет плюсом, если вы
- Обучали модели или применяли ML в работе: знакомы с LLM, CatBoost и другими инструментами
- Понимаете принципы CI/CD и автоматизировали процессы обработки данных