Point your AI agent at freehire and let it find you a job.

Get the CLI →

ПАО Сбербанк

Open 44d

Senior/Middle ML engineer (GigaCode R&D)

Posted Updated
Discussion

Summary

Research and train state-of-the-art code-focused LLMs for IDE assistants, focusing on pretraining, fine-tuning, and agentic tool use while publishing open-source tools and datasets.

Привет! Мы создаем современные универсальные агентные модели — они не просто отвечают текстом, а сами ходят в инструменты, пишут код, работают с базами данных и офисными сценариями. У нас работают лучшие эксперты по Data Science, разработчики агентных систем и AI‑ассистентов. Мы развиваем науку, пишем статьи, которые принимают на ведущие конференции, ведём исследования и создаем реальные инновации в AI — наши результаты доходят до применения в продуктах Сбера и публикаций в Open Source. 🚀 Почему это интересно: GigaCode R&D — одна из немногих команд в России, которые учат собственные LLM. Мы не просто верим, что наши модели могут конкурировать с мировыми, — мы доказываем это результатами на бенчмарках и в продуктах. И при этом остаёмся на стыке двух миров: разработки, которая идёт в готовые решения, и настоящих исследований, которые принесут пользу в будущем.* Ставить эксперименты с научной строгостью. Ты сможешь формулировать гипотезы и проверять их на практике * Дообучать LLM под доменные агентные задачи. Код, SQL, офис, кибербезопасность. SFT на траекториях, работа с форматами диалогов и вызовов инструментов, замер того, что реально изменилось после дообучения * Проектировать пайплайны синтетических агентных данных. Модель придумывает задачу → агент её решает → проверка → фильтр → датасет. Генерация задач из открытых данных, автоматическая проверка (ораклы, тесты, LLM-судья — где это уместно), очистка синтетики от мусора. * Придумывать задачи и бенчмарки для разных доменов: Код, SQL, офис, кибербезопасность и новые области * Построить и улучшать RL-пайплайн для обучения моделей Стек ML / DL · NLP / PLP · Агентные LLM · SFT · RL / RLVR · R&D• у тебя хорошие теоретические знания в ML и DL, с упором в современный NLP и трансформеры; • умеешь формулировать эксперименты с научной строгостью, обосновывать их, проводить самостоятельно и делать выводы; • есть опыт дообучения современных LLM под доменные задачи, генерации и очистки синтетических данных с помощью LLM, анализа проблемных мест в работе LLM и данных для обучения • есть увлечённость NLP/PLP. ━━━━━━━━━━━━━━━━━━━━ 🌟 Будет плюсом знание про: • Агентные бенчмарки (SWE-bench, Terminal-Bench, SQL/BIRD, CyberGym и похожие): как устроены задачи, ораклы, оценка • Генерация синтетики через LLM и оценка качества без ручной разметки • Устройство агентных фреймворков: инструменты, память, сжатие контекста, субагенты, траектории • Офисные и кибербез агентные задачи* комфортный современный офис рядом с м. Кутузовская * гибридный формат работы * ежегодный пересмотр зарплаты, годовая премия * корпоративный спортзал и зоны отдыха * система обучения для профессионального и карьерного развития * расширенный полис ДМС с первого дня работы и страхование для семьи * программа ипотеки для сотрудников * бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров * вознаграждение за рекомендацию друзей в команду Сбера.

Skills

What Senior ML / AI jobs ask for — and how much of it you have →

See also

ML / AI jobs by country — openings, pay and top skills →

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available