freehire launches on Product Hunt on 26 August.

Follow →

ML-разработчик в команду Alice AI VLM Reasoning

Open 50d posting dated 3 days ago
Мы учим мультимодальные модели понимать документы, графики и интерфейсы, распознавать текст, а также доводим их поведение до продуктового качества через RLHF. Если вы хотите драйвить мультимодальный reasoning и RL-алайнмент, работать со сложнейшими задачами на стыке текста, картинок и видео — ждём вас в команде!Развивать RL и RLHF для VLM
Вам предстоит переосмыслить методы алайнмента на стыке визуальной и текстовой модальностей: как наградить модель за правильный визуальный reasoning, как отучить её галлюцинировать при описании изображения и как превратить продуктовые требования сервисов Яндекса в функцию награды. Вы будете находить ответы на эти вопросы и внедрять решения в RLHF-пайплайн — так, чтобы поведение модели было предсказуемым, полезным и безопасным. Развивать reasoning и работу с документами (OCR)
Требуется выйти за пределы простых подписей к фото. Вы будете учить модель рассуждать над сложным визуальным контекстом: разбирать документы, таблицы, графики и интерфейсы, аккуратно распознавать текст (OCR) и безупречно следовать многошаговым инструкциям. Для этого предстоит собирать reasoning-данные и активно экспериментировать с UG-данными и AI-фидбэком. Разгонять large-scale-обучение до предельных скоростей
RL loop для мультимодальных моделей — это один из самых сложных инженерных вызовов в современном ML. Вам предстоит ускорять генерацию на лету, профилировать узкие места и добиваться того, чтобы эксперименты крутились кратно быстрее, а GPU не простаивали ни секунды. Больше об ML в Яндексе — в канале Yandex for ML* Отлично знаете классические ML, NLP и CV * Понимаете, как устроены современные LLM или VLM, решали с их помощью прикладные задачи или имеете релевантный исследовательский опыт * Имеете опыт работы с RL или RLHF, post-training или мультимодальным reasoning — или готовы быстро погрузиться в эти направления * Следите за трендами в области LLM и VLM, умеете с ходу отличать хайп от рабочих практик и готовы быстро реализовывать новые идеи* Работали с reasoning-задачами, post-training или RLHF/alignment * Имеете опыт работы с OCR и document understanding: распознавание текста, структуры документов, таблиц и графиков * Обучали большие модели или large-scale ML-системы * Понимаете ограничения современных VLM и следите за трендами в multimodal reasoning

See also

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available