Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой, после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
ASTON — аккредитованная аутсорсинговая IT-компания, работающая с 2007 года. В компании более 2500 специалистов, которые разрабатывают программное обеспечение и IT-решения для сфер Finance, Healthcare, eCommerce, IoT, Media, Big Data и ML. Вакансия предполагает работу над проектом быстрорастущей ИТ-компании, создающей цифровые решения для крупнейших финансовых организаций, включая финтех-продукты, решения для работы с большими данными и цифровизации бизнес-процессов.
задачи
Развёртывать, настраивать и сопровождать Langfuse в защищённых контурах банка, включая PostgreSQL, ClickHouse, Redis и объектное хранилище;
Организовывать интеграцию с Apache Kafka: создавать и сопровождать топики, настраивать ACL, consumer groups, retention, репликацию, DLQ/retry-механизмы и мониторить Kafka lag;
Поддерживать потоки телеметрии моделей, включая результаты работы ML-моделей, LLM traces, события RAG-пайплайнов, метрики качества, технические логи и алерты;
Развёртывать и эксплуатировать сервисы в Kubernetes/OpenShift: namespaces, RBAC, Secrets, ConfigMaps, Ingress, resource limits/requests, autoscaling и сетевые политики;
Разрабатывать и сопровождать Helm-чарты, Kubernetes-манифесты и шаблоны конфигурации для dev/test/preprod/prod-контуров;
Строить и поддерживать CI/CD- и GitOps-конвейеры: сборку, тестирование, сканирование, публикацию артефактов, деплой и rollback;
Автоматизировать инфраструктуру и конфигурации с использованием Ansible, Terraform или аналогичных средств;
Настраивать мониторинг, централизованное логирование и алертинг с помощью Prometheus, Grafana, Alertmanager, ELK/Opensearch или аналогов;
Сопровождать и проводить первичную оптимизацию PostgreSQL, ClickHouse, Redis, Kafka, Nginx/Ingress и смежных инфраструктурных компонентов;
Обеспечивать отказоустойчивость, резервное копирование, восстановление и планирование ресурсов платформы;
Участвовать в разборе инцидентов, готовить RCA и runbook’и, а также мероприятия по предотвращению повторных сбоев;
Обеспечивать требования информационной безопасности: управлять доступами, секретами и сертификатами, настраивать сетевую сегментацию и аудит, устранять уязвимости;
Вести эксплуатационную и техническую документацию по сервисам, интеграциям и процедурам сопровождения.
требования
Опыт работы DevOps/SRE-инженером от 5 лет;
Практический опыт эксплуатации Kubernetes или OpenShift в production-среде: Helm, RBAC, networking, autoscaling, диагностика и настройка ресурсов;