Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой, после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Команда алайнмента Alice AI обучает модель вести диалог, рассуждать, следовать инструкциям и пользоваться поиском и другими инструментами. Её цель — улучшать качество модели после базового обучения.
задачи
Формулировать гипотезы, проводить эксперименты, оценивать изменения в поведении модели и использовать выводы в следующих итерациях;
Разрабатывать RL-методы для обучения LLM, повышать качество и стабильность обучения;
Создавать инструменты для оценки состояния модели во время экспериментов;
Проверять исследовательские идеи на моделях и переносить работающие решения в основной контур обучения;
Исследовать способы объединения стадий обучения и сохранять вклад экспериментов в итоговое качество модели;
Собирать модели-кандидаты и проводить комплексную оценку;
Поддерживать стенд для быстрых экспериментов и приёмки изменений;
Развивать методы обучения, данные и оценку поведения модели, чтобы она следовала системным инструкциям;
Проверять качество модели с помощью экспертной разметки, reward-моделей и LLM-as-a-Judge;
Развивать reasoning, tool calling и перенос качества модели на новые сценарии.
требования
От 3 лет опыта;
Хорошо знать классический ML и DL;
Понимать устройство современных LLM и методы их обучения;
Уметь переводить исследовательскую задачу в проверяемую гипотезу, эксперимент и метрики;
Уметь интерпретировать результаты и находить причины изменений качества;
Интересоваться моделями с reasoning и tool calling;
Будет плюсом опыт в online RL для LLM, многостадийном обучении, distillation, instruction following, reward modeling или оценке поведения языковых моделей.
условия
Компенсация от 100М токенов для экспериментов и оптимизации рутины;
Доступ к передовым моделям для ежедневной работы;
Расширенная медицинская страховка с первого месяца работы;
Оплачиваемый больничный: 30 дней в году с сохранением полной зарплаты;
ДМС покрывает плановую и неотложную помощь за рубежом, страхование от несчастных случаев и лечение критических заболеваний;
Онлайн-консультации с психологами и психотерапия в офисах с соответствующим кабинетом;
Ежегодные чекапы и вакцинация;
ДМС покрывает стоматологию и экстренную помощь за рубежом;
После года работы ДМС покрывает коррекцию зрения и хирургическое лечение косоглазия;
В крупных офисах доступны кабинеты врача-терапевта;
Ведение беременности и роды оплачиваются сотрудницам и жёнам сотрудников со стажем более двух лет;
Страховка для детей и супругов по системе 80/20: работодатель оплачивает 80% стоимости ДМС, сотрудник — 20%.