Инженер данных в команду UGC Поиска
Summary
Инженер данных в Яндекс Поиске собирает и обрабатывает миллионы отзывов пользователей, строит модели для ранжирования и анализа Big Data, чтобы улучшать выдачу и продукты.
Ежедневно миллионы пользователей приходят в Яндекс Поиск, чтобы купить товар, выбрать фильм, найти врача и решить другие задачи. Мы развиваем инфраструктуру для сбора и обработки отзывов, чтобы пользователям было проще принимать решения. Ищем инженера данных, который поможет нам в этом.Сбор отзывов от пользователей
Наша основная задача — поделиться с пользователями Яндекса реальным опытом реальных людей. Для этого нужно находить пользователей, готовых оставить свой отзыв о товарах и услугах, а также нужно доносить опросы до разных площадок Поиска. Показ агрегированного опыта пользователей
Для отображения отзывов используется множество эвристик и моделей: подсчёт рейтингов и их динамики, ранжирование отзывов, выделение важных аспектов в отзывах, модерация контента. Полученные данные нужно донести до пользователей и других сервисов Яндекса. Аналитика
В ходе работы потребуется внедрять метрики и мониторинги качества, обрабатывать и анализировать Big Data, предлагать идеи для улучшения продуктов. Больше о разработке в Яндексе — в канале Yandex for Developers* Работали в роли старшего разработчика, дата‑инженера или тимлида больше трёх лет * Владеете инструментами и технологиями работы с большими данными, например Hadoop, Spark, SQL, Python * Знакомы с C++ * Нацелены на результат и готовы отвечать за влияние своих решений на работу продукта* Обучали модели или применяли ML в работе: знакомы с LLM, CatBoost и другими инструментами * Понимаете принципы CI/CD и автоматизировали процессы обработки данных
Наша основная задача — поделиться с пользователями Яндекса реальным опытом реальных людей. Для этого нужно находить пользователей, готовых оставить свой отзыв о товарах и услугах, а также нужно доносить опросы до разных площадок Поиска. Показ агрегированного опыта пользователей
Для отображения отзывов используется множество эвристик и моделей: подсчёт рейтингов и их динамики, ранжирование отзывов, выделение важных аспектов в отзывах, модерация контента. Полученные данные нужно донести до пользователей и других сервисов Яндекса. Аналитика
В ходе работы потребуется внедрять метрики и мониторинги качества, обрабатывать и анализировать Big Data, предлагать идеи для улучшения продуктов. Больше о разработке в Яндексе — в канале Yandex for Developers* Работали в роли старшего разработчика, дата‑инженера или тимлида больше трёх лет * Владеете инструментами и технологиями работы с большими данными, например Hadoop, Spark, SQL, Python * Знакомы с C++ * Нацелены на результат и готовы отвечать за влияние своих решений на работу продукта* Обучали модели или применяли ML в работе: знакомы с LLM, CatBoost и другими инструментами * Понимаете принципы CI/CD и автоматизировали процессы обработки данных