Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой, после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Фарпост строит гибкую cloud-first инфраструктуру для обучения и инференса больших моделей и сопутствующих микросервисов. Среда включает гибрид частных облаков OpenStack и современные инструменты оркестрации; инфраструктура развивается как предсказуемый, масштабируемый и безопасный продукт — от оборудования до пода.
задачи
Проектировать и развивать cloud-first инфраструктуру для ML-задач, GPU-кластеров, инференса и микросервисов;
Строить и оптимизировать CI/CD-пайплайны в GitLab CI;
Развёртывать, отлаживать и масштабировать кластеры Kubernetes;
Настраивать Ingress, HPA/VPA и сетевые политики;
Работать с Helm-чартами;
Управлять частными облаками на базе OpenStack;
Настраивать мониторинг и наблюдаемость с Prometheus, Grafana и Loki;
Внедрять SLO/SLI и отслеживать их выполнение;
Реализовывать инфраструктуру как код с Terraform/Terragrunt;
Разрабатывать модули, управлять состоянием и удалёнными бэкендами;
Интегрировать Terraform/Terragrunt с Ansible для конфигурации;
Обеспечивать безопасность инфраструктуры;
Управлять секретами с Vault и Sealed Secrets;
Настраивать RBAC и сетевые политики;
Выполнять hardening операционной системы и кластера;
Администрировать Linux-серверы;
Диагностировать производительность;
Писать скрипты на Bash и Python для автоматизации рутинных задач.
требования
Коммерческий опыт от 5 лет в роли DevOps, SRE или Platform Engineer;
Глубокое знание GitLab CI;
Экспертное владение Kubernetes;
Опыт установки и настройки кластеров kubeadm/k0s;
Опыт работы с OpenStack;
Навыки настройки мониторинга на базе Prometheus и Grafana;
Знание Loki и понимание SLO/SLI;
Практический опыт с Terraform/Terragrunt;
Опыт использования Ansible для конфигурации серверов;
Знание Vault и Sealed Secrets;
Навыки настройки RBAC и сетевых политик;
Знание hardening Linux и Kubernetes;
Уверенное администрирование Linux;
Умение диагностировать проблемы с нагрузкой, сетью и дисками;
Навыки Bash и Python;
Самостоятельность в постановке задач;
Проактивный поиск узких мест;
Отличная коммуникация с разработчиками и коллегами;
Будет плюсом опыт с GitOps, углублённые навыки безопасности, мультипроектность, опыт в MLOps, работа с S3-совместимыми хранилищами и Model Registry.
условия
Реальные задачи на стыке DevOps и MLOps;
Возможность влиять на решения команды и видеть результаты своей работы;
Предсказуемый онбординг и помощь наставника;
Оплата тренингов, семинаров и конференций;
Корпоративная библиотека;
Оформление по ТК;
Пересмотры зарплаты по итогам performance review;
Неформальная рабочая атмосфера и гибкость процессов;