Т1
22 сен

devops инженер платформы искусственного интеллекта

ориентир по рынку
вакансия зп не указана
в среднем 328 556 ₽
Загрузи резюме, чтобы видеть мэтчи с вакансией

подготовьтесь к отклику

ai-инструменты

Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме

описание

Команда развивает инфраструктуру платформы искусственного интеллекта для внутренних команд, рыночных внедрений и внешних клиентов.

задачи

  • Проектировать, развёртывать и развивать инфраструктуру платформы искусственного интеллекта в локальных и облачных средах;
  • Строить и поддерживать CI/CD/CT-пайплайны для ML-моделей и сервисов;
  • Интегрировать и эксплуатировать LLM/ML-сервисы для внутренних команд и рыночных внедрений;
  • Упаковывать модели в сервисы, настраивать автомасштабирование, SLA и наблюдаемость;
  • Настраивать мониторинг и оповещения по инфраструктуре и моделям;
  • Реагировать на инциденты и участвовать в разборе их причин;
  • Автоматизировать ML-пайплайны: подготовку данных, обучение, переобучение, регистрацию моделей и управление версиями и окружениями;
  • Поддерживать внедрения у клиентов;
  • Тиражировать платформенные компоненты и адаптировать инфраструктуру под контур заказчика;
  • Участвовать в оптимизации производительности и затрат на GPU/CPU;
  • Проектировать и развёртывать инфраструктуру платформы ИИ под LLM/ML-нагрузки;
  • Строить воспроизводимые ML-пайплайны для обучения, валидации, упаковки моделей и развёртывания в пакетном режиме и режиме реального времени;
  • Настраивать мониторинг моделей, автоматический откат и триггеры повторного обучения;
  • Взаимодействовать с аналитиками данных, разработчиками и специалистами по внедрению;
  • Переводить экспериментальные ноутбуки в надёжные сервисы для внутренних и внешних клиентов.

требования

  • Высшее образование;
  • Опыт работы от 5 лет;
  • Глубокое понимание жизненного цикла ML-модели от экспериментов до промышленного инференса и мониторинга;
  • Уверенное владение Linux, сетевыми основами, безопасностью, контейнерами и оркестраторами;
  • Опыт построения CI/CD-пайплайнов для сервисов и ML-артефактов;
  • Опыт работы с LLM/GenAI-платформами: vLLM, TGI, Hugging Face, Triton/ONNX Runtime;
  • Опыт оптимизации инференса;
  • Опыт построения feature store, реестра моделей и ML-пайплайнов;
  • Опыт работы с гибридной инфраструктурой: локальные кластеры и публичные облака;
  • Понимание оптимизации затрат и FinOps для GPU/CPU;
  • Знание Python и Bash;
  • Опыт работы с Docker, Docker Compose и Kubernetes, включая Helm и Operators;
  • Опыт работы с GitLab CI, GitHub Actions, Jenkins или Argo CD;
  • Опыт работы с Terraform или Ansible, конфигурацией Linux-серверов, Nginx и cert-manager;
  • Опыт работы с Apache Kafka, Airflow, Argo Workflows, S3-совместимыми хранилищами, MLflow или Weights & Biases;
  • Опыт работы с Prometheus, Grafana, Loki/ELK, Sentry и Alertmanager;
  • Будет плюсом GitLab, GitHub, Jira, Confluence, Kubeflow, kubectl, Helm, K9s, Lens, MLflow, Weights & Biases, Kubeflow Pipelines, Airflow, реестр моделей, Prometheus, Grafana, Loki/ELK, Alertmanager, Sentry.

условия

  • Условий в вакансии нет

Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайтесь: это мошенничество.

Про зарплаты

Анонимные данные по зарплатам и грейдам.
Можно сверить вилку с рынком.

Посмотреть зарплаты

Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайтесь: это мошенничество.