devops инженер платформы искусственного интеллекта
ориентир по рынку
вакансия
зп не указана
в среднем
328 556 ₽
мэтч
Загрузи резюме, чтобы видеть мэтчи с вакансией
Загрузить
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
загрузить резюме
описание
Команда развивает инфраструктуру платформы искусственного интеллекта для внутренних команд, рыночных внедрений и внешних клиентов.
задачи
Проектировать, развёртывать и развивать инфраструктуру платформы искусственного интеллекта в локальных и облачных средах; Строить и поддерживать CI/CD/CT-пайплайны для ML-моделей и сервисов; Интегрировать и эксплуатировать LLM/ML-сервисы для внутренних команд и рыночных внедрений; Упаковывать модели в сервисы, настраивать автомасштабирование, SLA и наблюдаемость; Настраивать мониторинг и оповещения по инфраструктуре и моделям; Реагировать на инциденты и участвовать в разборе их причин; Автоматизировать ML-пайплайны: подготовку данных, обучение, переобучение, регистрацию моделей и управление версиями и окружениями; Поддерживать внедрения у клиентов; Тиражировать платформенные компоненты и адаптировать инфраструктуру под контур заказчика; Участвовать в оптимизации производительности и затрат на GPU/CPU; Проектировать и развёртывать инфраструктуру платформы ИИ под LLM/ML-нагрузки; Строить воспроизводимые ML-пайплайны для обучения, валидации, упаковки моделей и развёртывания в пакетном режиме и режиме реального времени; Настраивать мониторинг моделей, автоматический откат и триггеры повторного обучения; Взаимодействовать с аналитиками данных, разработчиками и специалистами по внедрению; Переводить экспериментальные ноутбуки в надёжные сервисы для внутренних и внешних клиентов.
требования
Высшее образование; Опыт работы от 5 лет; Глубокое понимание жизненного цикла ML-модели от экспериментов до промышленного инференса и мониторинга; Уверенное владение Linux, сетевыми основами, безопасностью, контейнерами и оркестраторами; Опыт построения CI/CD-пайплайнов для сервисов и ML-артефактов; Опыт работы с LLM/GenAI-платформами: vLLM, TGI, Hugging Face, Triton/ONNX Runtime; Опыт оптимизации инференса; Опыт построения feature store, реестра моделей и ML-пайплайнов; Опыт работы с гибридной инфраструктурой: локальные кластеры и публичные облака; Понимание оптимизации затрат и FinOps для GPU/CPU; Знание Python и Bash; Опыт работы с Docker, Docker Compose и Kubernetes, включая Helm и Operators; Опыт работы с GitLab CI, GitHub Actions, Jenkins или Argo CD; Опыт работы с Terraform или Ansible, конфигурацией Linux-серверов, Nginx и cert-manager; Опыт работы с Apache Kafka, Airflow, Argo Workflows, S3-совместимыми хранилищами, MLflow или Weights & Biases; Опыт работы с Prometheus, Grafana, Loki/ELK, Sentry и Alertmanager; Будет плюсом GitLab, GitHub, Jira, Confluence, Kubeflow, kubectl, Helm, K9s, Lens, MLflow, Weights & Biases, Kubeflow Pipelines, Airflow, реестр моделей, Prometheus, Grafana, Loki/ELK, Alertmanager, Sentry.
Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайтесь: это мошенничество.
Про зарплаты
Анонимные данные по зарплатам и грейдам. Можно сверить вилку с рынком.
Посмотреть зарплаты
статьи для DevOps-инженеров