Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузи резюме
О рекламодателе
ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ "ЦЕНТР НАЦИОНАЛЬНЫХ ИНТЕЛЛЕКТУАЛЬНЫХ СИСТЕМ" ИНН: 9704271170
описание
Первый этап отбора на эту вакансию – общение с AI-рекрутером. После отклика вам на почту и в чат на платформе HeadHunter придет приглашение пройти первичное интервью с ГигаРекрутером в Telegram. Диалог займёт примерно 10 минут. Его задача — уточнить недостающие детали и ускорить рассмотрение вашей кандидатуры. ГигаРекрутер только начинает свой путь, поэтому просим относиться с пониманием. Ваш опыт и участие помогут сделать его удобным и полезным!
GigaChat Vision — команда, которая занимается полным циклом обучения VLM-моделей.
задачи
Разрабатывать и улучшать RL-подходы для обучения VLM/LLM-моделей: выбирать алгоритмы, ставить эксперименты и анализировать результаты
Проектировать reward-функции и пайплайны обучения, выстраивать стратегии масштабирования под разные домены и сценарии, влиять на метрики качества
Определять требования к данным для RL и участвовать в построении пайплайнов сбора, фильтрации и подготовки датасетов
Развивать систему оценки качества reasoning: внедрять и улучшать метрики в существующем eval-фреймворке, предлагать новые способы измерения качества
Согласовывать решения со смежными направлениями Pretrain, SFT и Infra, переносить эксперименты в производственный пайплайн
Следить за развитием области и превращать идеи из статей в проверяемые эксперименты и инженерные решения
Разбираться в технических задачах, отлаживать эксперименты, анализировать аномалии обучения, находить узкие места и доводить решения до результата
Делиться экспертизой с командой, участвовать в проверке кода и помогать улучшать качество решений и подходы к экспериментам
Развивать инфраструктуру для RL
требования
Глубокое понимание RL для LLM/VLM, включая RLHF, GRPO и PPO, и практический опыт
Понимание полного цикла обучения VLM/LLM: pretrain, SFT и RL, а также влияния каждого этапа на итоговые метрики
Опыт распределённого обучения с DeepSpeed и FSDP, а также работы с фреймворками inference
Практический опыт постановки, проведения и анализа RL-экспериментов
Умение самостоятельно решать сложные технические задачи в условиях неопределённости
Умение выстраивать процессы в условиях неопределённости
Опыт взаимодействия со смежными командами и заинтересованными сторонами
Системное мышление: способность видеть весь цикл от данных и проектирования reward до оценки и производственных метрик
Будет плюсом: опыт менторинга или технического лидерства в отдельных проектах, публикации или вклад в открытый исходный код в области RL/LLM/VLM, опыт вывода моделей, обученных с RL, в производство и поддержки их качества
условия
Возможность выбрать гибридный формат или работу в офисе
Ежегодный пересмотр зарплаты и годовая премия
Корпоративный спортзал и зоны отдыха
Более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
Расширенная ДМС, льготное страхование для семьи и корпоративная пенсионная программа
Ипотека на выгодных условиях — до 7% для каждого сотрудника
Бесплатная подписка СберПрайм+, скидки на продукты компаний-партнёров
Вознаграждение за рекомендацию друзей в команду Сбера
Крупнейший российский банк и экосистема. Предоставляет банковские услуги: кредиты, вклады, карты, ипотека. Развивает сервисы: доставка, здоровье, развлечения, облачные технологии и ИИ. Удобно для финансов и повседневных задач.