сегодня

site reliability engineer для AI-платформы

ориентир по рынку
вакансия зп не указана
в среднем 219 880 ₽
Загрузи резюме, чтобы видеть мэтчи с вакансией

подготовься к отклику

ai-инструменты

Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузи резюме

Рекламный баннер: ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ "ЦЕНТР НАЦИОНАЛЬНЫХ ИНТЕЛЛЕКТУАЛЬНЫХ СИСТЕМ"
О рекламодателе
ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ "ЦЕНТР НАЦИОНАЛЬНЫХ ИНТЕЛЛЕКТУАЛЬНЫХ СИСТЕМ"
ИНН: 9704271170

описание

AI-платформа корпоративного уровня с чат-интерфейсом и сценариями сбора аналитики по внутренним базам знаний и открытым источникам. Платформа введена в промышленную эксплуатацию, работает с реальными пользователями; для обработки запросов используется LLM-шлюз.

задачи

  • Обеспечивать доступность и отказоустойчивость платформы в промышленной эксплуатации: определять и контролировать SLO/SLI, дежурить, разбирать инциденты и проводить postmortem
  • Разрабатывать и сопровождать CI/CD-конвейеры и инфраструктуру как код
  • Управлять Kubernetes-кластерами и их версиями, admission-контроллерами, сетевыми политиками, ограничениями ресурсов и автомасштабированием
  • Диагностировать и оптимизировать производительность CPU, памяти и операций ввода-вывода, профилировать нагрузку LLM-инференса
  • Настраивать и развивать наблюдаемость: метрики, логи, трассировки, оповещения и дашборды
  • Управлять секретами и доступом, выполнять требования безопасности
  • Настраивать и оптимизировать Kafka, Redis, PostgreSQL и S3, обеспечивать резервное копирование и восстановление, разрабатывать планы аварийного восстановления
  • Участвовать в архитектурных решениях для новых сервисов платформы

требования

  • Опыт работы от 3 лет в SRE, DevOps или платформенной инфраструктуре
  • Глубокий опыт эксплуатации Kubernetes в промышленной среде
  • Знание PostgreSQL: планирование запросов, индексы, репликация, резервное копирование и восстановление
  • Опыт работы с Kafka, Redis и S3-совместимыми объектными хранилищами
  • Знание CI/CD, Linux и Bash
  • Опыт работы с Prometheus, Grafana, OpenSearch, мониторингом и логированием
  • Понимание принципов SLO, SLI и бюджетов ошибок
  • Опыт работы с облачной и локальной инфраструктурой, сетевым уровнем и TLS
  • Будет плюсом: опыт эксплуатации ML/LLM-инференса, работа с векторными базами данных, знание IaC, участие в RAG- и AI-платформенных проектах, написание postmortem и улучшение процессов эксплуатации

условия

  • Годовой бонус и ежегодный пересмотр зарплаты
  • Статус аккредитованной ИТ-компании
  • Расширенный ДМС с первого дня и льготное страхование для семьи
  • Корпоративный университет, внутренняя образовательная платформа и участие в IT-конференциях
  • 90 Дней удалённой работы из любого региона РФ
  • Льготная ипотека в Сбере
  • Бесплатная подписка СберПрайм, которой можно поделиться с тремя близкими

Крупнейший российский банк и экосистема. Предоставляет банковские услуги: кредиты, вклады, карты, ипотека. Развивает сервисы: доставка, здоровье, развлечения, облачные технологии и ИИ. Удобно для финансов и повседневных задач.

Подробнее о компании →

Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайся: это мошенничество.

Про зарплаты

Анонимные данные по зарплатам и грейдам.
Можно сверить вилку с рынком.

Посмотреть зарплаты

Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайся: это мошенничество.