Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой — после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Команда занимается созданием нативных омнимодальных архитектур, разработкой новых способов кодирования и совместного обучения в доменах изображений, аудио и видео.
задачи
Разрабатывать принципиально новые мультимодальные представления и кодирование информации (vision, audio, video, text);
Создавать универсальные энкодеры и shared latent spaces;
Проектировать Vision-Language-Action (VLA) архитектуры и стрим взаимодействия с роботами;
Исследовать end-to-end омнимодальные модели и обучать их на масштабных мультимодальных датасетах.
требования
Отличное знание Python 3;
Опыт работы с PyTorch, bash, git, Docker, dvc;
Глубокое понимание representation learning и multimodal learning;
Умение быстро разбирать и воспроизводить идеи из научных статей;
Будет плюсом опыт с VLA / Embodied AI / Robotics, знание self-supervised и multimodal pretraining подходов, опыт работы с streaming video/audio, публикации, open-source вклад или исследовательский опыт.
условия
Комфортный современный офис рядом с м. Кутузовская;
Годовая премия;
Корпоративный спортзал и зоны отдыха;
Расширенный ДМС и страхование для семьи;
Ипотека для сотрудников со сниженной процентной ставкой;
Бесплатная подписка СберПрайм+ и скидки на продукты компаний-партнеров;