freehire launches on Product Hunt on 26 August.

Follow →

Ведущий разработчик Inference-server в отдел ML-инфраструктуры

Open 64d
Мы разрабатываем сервисы, которые позволяют быстро поднять подсчёт нейронных моделей и использовать их в продакшне. Ищем опытного специалиста, который будет внедрять универсальные для разных команд решения, интегрировать их с ML-платформой и готовить инфраструктуру для новых типов моделей.Помощь с внедрением решения по всей компании
В Яндексе не меньше 20 команд, занимающихся эксплуатацией ML-моделей. Чтобы сделать решение удобным для всех и дать всем возможность быстро проводить эксперименты, необходимо постоянно взаимодействовать с заказчиками и реализовывать необходимую для них функциональность, например новые бэкенды для применения нейросетей, или консультировать по поднятию новых инсталляций. Развитие коробочного решения для инференса
Сейчас у нас готова core-часть сервиса, но, чтобы сделать решение по-настоящему удобным, предстоит реализовать множество идей и наработок, таких как динамическая балансировка, многоуровневый in-memory-, disk-, remote-кеш, динамические конфиги, предстоит развивать инструменты для поднятия сервиса в облаке. Сравнение с общемировыми аналогами
Для создания хорошего конкурентного решения нам надо всегда смотреть по сторонам и перенимать лучшие практики и идеи. Для этого мы анализируем аналогичные решения: как для кода инференса (Triton Inference Server, KServe), так и для поднятия сервиса в системах деплоя (Seldon Core, Kubeflow). А также нам необходимо следить за трендами инференса и наперёд подготавливать инфраструктуру для новых размеров и типов моделей. Интеграция сервисов инференса с ML-платформой
Единая ML-платформа позволяет обучать и сравнивать запуски модели, но хочется, чтобы весь цикл жизни модели — и деплой, и эксплуатация — был доступен из неё. Для этого предстоит продумать сценарии использования инференса через ML-платформу и реализовать интеграцию с ней.* Имеете опыт в программировании не менее пяти лет * Уверенно владеете C++ или готовы быстро разобраться в нём * Были техническим лидером сервиса, составляли роадмап * Владеете Concurrency на C++ или Linux * При принятии решения в первую очередь думаете о пользе для бизнеса* Разрабатывали и проектировали высоконагруженные сервисы на C++ * Знакомы с устройством нейронных моделей, в свободном режиме следите за новинками в области * Проектировали, разворачивали и эксплуатировали сервисы для ML Inference на CPU/GPU * Уверенно знаете системы Unix и Linux: устройство процессов, файловой системы, системных вызовов и другое * Имеете представление о Triton, TRT LLM

See also

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available