Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
ASTON — аккредитованная аутсорсинговая IT-компания, работающая с 2007 года. В компании более 2500 специалистов, она разрабатывает программное обеспечение и IT-решения для сфер финансов, здравоохранения, электронной торговли, интернета вещей, медиа, больших данных и машинного обучения. Специалист будет работать над проектом заказчика — российского подразделения американского производителя продуктов питания и кормов для животных, работающего в России и странах СНГ с 1991 года.
задачи
Эксплуатировать и оптимизировать Kubernetes-кластеры, обеспечивая отказоустойчивость, автоскейлинг и мониторинг контейнерной инфраструктуры;
Разрабатывать и поддерживать ETL-пайплайны в Apache Airflow, включая обработку ошибок, версионирование DAG и развёртывание в Kubernetes;
Управлять базами данных PostgreSQL и ClickHouse: настраивать репликацию и резервное копирование, оптимизировать производительность, выполнять миграции с минимальным временем простоя;
Внедрять практики Data Mesh, управления данными и процессы DevOps: инфраструктуру как код, управление секретами, работу с инцидентами и аварийное восстановление.
требования
Опыт работы DevOps Engineer от 3 лет;
Владение Kubernetes и контейнерной инфраструктурой;
Навыки обновления кластера без простоя, диагностики подов и работы с постоянным хранилищем для stateful-нагрузок;
Опыт работы с автоскейлингом HPA, VPA и Cluster Autoscaler, понимание конвейера метрик, пользовательских метрик и взаимодействия механизмов;
Навыки мониторинга кластера и настройки оповещений через Prometheus или встроенный мониторинг облака;
Опыт работы с Terraform и Helm для развёртывания кластеров и приложений, создания модульной конфигурации и CI/CD для манифестов;
Опыт работы с Apache Airflow и оркестрацией ETL;
Понимание архитектуры Airflow и выбора исполнителя с учётом объёма и изоляции; опыт развёртывания Airflow в Kubernetes через Helm;
Умение обрабатывать ошибки и настраивать повторные попытки;
Навыки мониторинга и оптимизации DAG;
Навыки версионирования и развёртывания DAG, настройки отката и изоляции сред разработки, тестирования и эксплуатации;
Опыт работы с PostgreSQL и ClickHouse, понимание различий OLTP и OLAP, распределённых таблиц и механизмов хранения;
Навыки настройки репликации, восстановления на момент времени, резервного копирования и тестирования восстановления; понимание RPO и RTO;
Навыки анализа и оптимизации запросов, работы с индексами, партиционированием и материализованными представлениями;
Опыт миграции данных;
Опыт работы с Terraform для облачной инфраструктуры, управления секретами, их ротацией и минимальными привилегиями;
Навыки мониторинга и оповещений по метрикам и логам инфраструктуры и приложений, создания панелей, работы с SLO/SLI и дежурствами; опыт трассировки ETL-пайплайнов;
Навыки диагностики сбоев ETL, восстановления упавшего планировщика, миграции больших объёмов данных и настройки развёртывания blue-green с минимальным риском.
условия
Обсуждение зарплаты отдельно с каждым кандидатом;
Оформление по ТК РФ;
ДМС со стоматологией;
Частичная компенсация расходов на спорт;
Оплачиваемые больничные дни и период ожидания проекта;
Компенсация расходов на коворкинг;
Ментор на всё время работы и поэтапная адаптация;
Доплаты за наставничество, ведение обучающих курсов, проверку проектов и другие профессиональные активности;
Корпоративный портал с материалами для обучения и развития, технические встречи и конференции;
Корпоративные мероприятия, тимбилдинги, детские праздники и мастер-классы с подарками и сладостями для семей сотрудников;