Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой, после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Xsolla — глобальный лидер в сфере видеоигровой коммерции. Компания помогает разработчикам игр запускать, развивать, распространять, продвигать и монетизировать игры по всему миру с помощью решений для Direct-to-Consumer-коммерции, платежей, интеллектуальной работы с IP и вовлечения игроков. Xsolla выступает merchant of record в более чем 200 регионах и предоставляет доступ к более чем 1000 локальных платежных методов.
задачи
Отвечать за инфраструктуру на уровне приложений: Helm-чарты, конфигурации Terraform, Kubernetes-деплойменты, runtime-конфигурацию, сетевые настройки и интеграции сервисов;
Отвечать за наблюдаемость в рамках продуктового домена: проектировать и внедрять SLO/SLI, мониторы, алерты и дашборды для критичных сервисов с использованием Datadog и инструментов на базе OpenTelemetry;
Помогать создавать и развивать CI/CD-пайплайны для сервисов домена, включая автоматизацию развертывания и отката изменений;
Выполнять планирование производительности и емкости инфраструктуры, проводить настройку производительности перед пиковыми нагрузками;
Проводить нагрузочное тестирование и расследовать регрессии производительности;
Проводить Production Readiness Review для новых сервисов и значительных изменений;
Определять и контролировать критерии готовности сервисов домена к эксплуатации в production;
Участвовать в реагировании на инциденты, подготовке post-mortem и реализации улучшений надежности;
Поддерживать runbook-документацию в актуальном состоянии;
Разрабатывать автоматизацию для сокращения рутинных операционных задач;
Создавать автоматизацию runbook-процедур, инструменты для развертывания и регулярные операционные скрипты;
Совместно с техническими лидерами продуктовых команд формировать и развивать долгосрочный roadmap по надежности домена;
Участвовать в планировании, refinement-сессиях и архитектурных ревью продуктовых команд;
Обеспечивать учет требований к надежности на ранних этапах проектирования и принятия архитектурных решений;
Совместно с основной SRE-командой разрабатывать корпоративные стандарты в области SLO/SLI, capacity planning и эксплуатации;
Участвовать в улучшении общих подсистем, находящихся в зоне ответственности SRE;
Участвовать в дежурствах SRE-команды и поддерживать разработчиков по всей компании.
требования
От 3 лет подтвержденного опыта работы в роли SRE, DevOps- или Platform Engineer;
Опыт участия в дежурствах, реагировании на инциденты, ответственности за SLO и мониторинг, работы с пайплайнами развертывания и инфраструктурой production-сервисов;
Опыт разработки и выпуска backend-сервисов;
Умение читать и анализировать код приложения при расследовании проблем;
Умение писать автоматизацию производственного качества как минимум на одном языке программирования, например Go или PHP;
Практический опыт работы с Kubernetes, Helm, манифестами и стратегиями развертывания;
Опыт диагностики проблем производительности и сетевого взаимодействия на уровне приложений;
Опыт работы с GKE или другими управляемыми Kubernetes-платформами;
Уверенные знания и практический опыт в области наблюдаемости;
Опыт создания мониторов, дашбордов и SLO/SLI на современных платформах;
Знакомство с OpenTelemetry;
Опыт работы с Infrastructure as Code, Terraform или Terragrunt;
Опыт работы с GCP, включая IAM, сети и управляемые сервисы;
Опыт создания и поддержки CI/CD-пайплайнов в GitLab CI и/или GitHub Actions;
Уверенные навыки программирования и написания скриптов для создания автоматизации и внутренних инструментов;
Практический опыт реагирования на инциденты, проведения post-mortem и реализации улучшений надежности;
Сильные коммуникативные навыки и умение эффективно работать в команде;
Опыт работы с платежными системами, финтехом, электронной коммерцией или игровыми продуктами с высоконагруженными транзакционными системами;
Будет плюсом сертификация по Kubernetes, сертификация Google Cloud Platform, сертификация HashiCorp.
условия
Доступ к внутренней платформе для развития и обучения;
Участие в профессиональных конференциях, хакатонах, митапах и воркшопах;
Топовое оборудование Mac;
Доступ к продвинутым ИИ-сервисам;
ДМС со стоматологией для сотрудника и членов его семьи;
21 День больничного с доплатой до размера зарплаты;
Участие в международных проектах;
Командировки;
Потенциальная релокация в один из зарубежных офисов;
Компенсация расходов на обустройство эргономичного рабочего места дома для удалённых сотрудников.