Старший LLM-разработчик в команду алайнмента Alice AI LLM
Продумывать масштабируемые модели награды и улучшать различные В2С-свойства модели (человечность, красоту ответа) при помощи RLHF. Усиливать reasoning-свойства моделей
Разрабатывать модели награды и тренировки, повышающие точность пошагового рассуждения, надёжность планирования и способность модели проверять себя. Строить RAG следующего поколения
Не просто учить модель использовать контексты, но и понимать их пользу в каждом конкретном сценарии. Работать с агентскими моделями
Улучшать агентские свойства модели, извлекать пользу из tool-call-режима для продуктов. Улучшать модель на образовательных задачах
Превращать Alice AI LLM в помощника не только для школьника, но и развивать её в области сложных вузовских предметов. Больше об ML в Яндексе — в канале Yandex for ML* Отлично знаете классические ML и NLP * Понимаете, как устроены современные LLM, решали с их помощью прикладные задачи или имеете релевантный исследовательский опыт * Следите за трендами в области LLM. Можете бегло прочитать статью и быстро понять основную идею