Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой, после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Группа разработки HPC-инфраструктуры создаёт суперкомпьютер для обучения моделей во всей компании. Она строит HPC-сегменты с использованием InfiniBand и RoCE, а также ML-платформу на базе Kubernetes. AI VK развивает технологии искусственного интеллекта для ключевых продуктов VK, включая систему рекомендаций и поиска контента на платформах.
задачи
Разрабатывать и развивать компоненты ML-платформы и инфраструктурные сервисы;
Автоматизировать процессы запуска, сопровождения и мониторинга ML/HPC-нагрузок;
Повышать надёжность, производительность и масштабируемость платформы;
Развивать CI/CD и внутренние инструменты для эксплуатации платформы;
Взаимодействовать с командами разработки и ML-инженерами по вопросам платформы и инфраструктуры.
требования
Иметь опыт разработки инфраструктурных и платформенных компонентов на Go;
Глубоко знать Linux, включая устройство операционной системы, сетевой стек и механизмы контейнеризации;
Хорошо понимать сети, сетевые протоколы и диагностику проблем связности;
Знать архитектуру и принципы работы Kubernetes;
Владеть навыками поиска и устранения проблем на всех уровнях инфраструктуры: хост, контейнеры, среда выполнения, сеть;
Иметь опыт автоматизации инфраструктурных процессов и разработки внутренних инструментов;
Понимать принципы надёжности, масштабируемости и наблюдаемости промышленных систем;
Будет плюсом опыт работы с ML, MLOps и HPC-нагрузками, опыт разработки на Python, опыт работы с CI/CD, мониторингом и платформенными инструментами.